Гъвкавост в корпоративна Америка, AI „tokenmaxxing“ изчезва, тъй като работните места се стремят да намалят разходите за технологии
Корпоративната мода на „ tokenmaxxing “ върху технологията за изкуствен интелект доближава своите граници, защото работните места, хвърлящи AI във всичко, виждат разноските да се повишават без сходен скок в продуктивността.
Това, което стартира като пролетен звук, подхранван от софтуерната промишленост изстискването на допустимо най-вече генерирана от AI работа от артикули като ChatGPT на OpenAI и Claude на Anthropic се пренасочи към лятна реакция.
„ Много е елементарно да създадете нещо, от което не се нуждаете с AI “, сподели Винсент Гусдорф, началник на анализите на AI в Moody's Ratings и създател на нов отчет, който предлага по-дисциплиниран метод.
„ Tokenmaxxing “ се отнася до оптимално потребление на токени – градивните детайли на генеративния AI, които подхождат на дребни части текст, които AI система чете или записва. Всяка лексема е към три четвърти от дума. И нормално има ограничаване за това какъв брой можете да употребявате, като по-скъпите версии на AI артикули оферират по-високи тавани.
„ Когато сметките започнаха да се натрупат, хората осъзнаха, че тези нови принадлежности са много скъпи и би трябвало да ги употребявате рационално “, сподели Гусдорф.
Техническите ръководители дефинират високото потребление на AI като почетен знак
Само преди няколко месеца ръководителите на Силиконовата котловина насърчаваха високото ползване на токени като сигнал за високопроизводителни чиновници. Стереотипният tokenmaxxer оставаше до късно – може би игнорирайки половинката си – до момента в който ръководеше войска от 24-часови сътрудници с изкуствен интелект, изпълняващи работа от тяхно име.
Главният изпълнителен шеф на OpenAI Сам Олтман сподели през май, че е „ разчувствуван да види какво ще се случи със започващите компании tokenmaxxing, както за това по какъв начин работят вътрешно, по този начин и за продуктите, които могат да основат “.
Прочетете повече
Главният изпълнителен шеф на Nvidia Дженсън Хуанг сподели, че „ в случай че вашият $500K инженер не изгаря $250K в токени, нещо не е наред. “ Родителят на Фейсбук Мета имаше вътрешно съревнование за възнаграждаване на потреблението на токени.
Тенденцията увеличи приходите за водещи разработчици на огромни езикови модели на ИИ като Anthropic и OpenAI, само че се провали, защото стана ясно, че това не е безусловно най-хубавата тактика за всички останали.
Главният изпълнителен шеф на Microsoft Сатя Надела призна, че tokenmaxxing може да бъде пристрастяващ, само че предизвести в скорошна обява в блога, че клиентите на тези модели заплащат два пъти за AI, първо като харчат за токени и второ, като им подават всички свои лични данни. Докато насърчаваше личния метод на Microsoft, мненията на Надела бяха необикновени по метода, по който той повдигна подозрения по отношение на гаранциите за отбрана на данните на водещи снабдители на AI.
Изпълнителният шеф на Palantir Алекс Карп отиде по-далеч, като сподели на CNBC по-рано този месец, че нещо се е объркало „ изцяло “. Той сподели, че насочва гласа на американския бизнес, който е частно „ гневен “ по отношение на заплащането толкоз доста за токени, които не основават стойност.
„ Основното мнение измежду предприятията в тази страна е: „ Ще се отпусна и ще си изгубвам времето с токени. Няма да получа никаква стойност, а те ще получат моя IP “, сподели Карп.
Регистрирайте се за Morning Wire: Нашият водещ бюлетин разрушава най-големите заглавия за деня. Имейл адрес Запишете се Като поставите отметка в това поле, вие се съгласявате с AP Условия за прилагане и удостоверяваме, че AP може да събира и употребява вашите данни според нашите Политика за дискретност.
Работните места търсят повече по-добро „ маршрутизиране “ на работата си с ИИ
Консултантът по ръководство на Bain & Company Джу Уанг сподели, че доста от огромните бизнеси, които компанията й поучава, са разгледали по-отблизо възвръщаемостта на своите вложения в ИИ.
„ Разходите за токени за тях се удвояват, съвсем всеки втори месец “, сподели тя. " Да кажем $200 на програмист на месец. Умножете това по 20 000 разработчици, с което постоянно си имаме работа в тези компании, и това бързо ви води до число, което не е контрактувана позиция, която който и да е общоприет управител е възнамерявал. "
Понякога това просто значи да не употребявате AI еквивалента на чук, с цел да счупите гайка.
„ Не всичко се нуждае от Claude Opus 4.6 “, сподели тя за един от по-способните модели на Anthropic, подобаващи за софтуерно инженерство или задълбочени проучвания. „ И въпреки всичко виждате толкоз доста компании, толкоз доста консуматори, които по дифолт употребяват Opus за всичко, в това число генериране на имейли. “
Това докара до търсене на принадлежности, които правят AI „ маршрутизиране на модели “ – при които по-лесните поръчки се изпращат автоматизирано към по-евтини и по-ефективни AI системи, а по-сложните задания отиват към по-мощни модели.
Моделите AI с отворен код, основани в Китай, оферират по-евтини други възможности
Софтуер Разработчикът Хасан Ел Мгари сподели, че шокът от стикерите на фирмите от „ нелепата сума пари “, изхарчена за абонаменти за AI артикули от водещи американски компании, е предиздвикал мнозина да се откажат от възнаграждаване на високата приложимост.
„ По-добре е просто да дадете опция на чиновниците по какъв начин да употребяват тези неща и да им позволите да употребяват AI, когато и колкото им е належащо “, сподели Ел Мгари, който управлява опита на разработчиците в стартъпа Together AI, който доставя на разработчиците разнообразни модели на AI с „ отворен код “.
В същото време тези, които избират натрупването на допустимо най-вече жетони, имат полеви дни с нови модели с отворен код от китайски започващи компании като Kimi на Moonshot или GLM на Zhipu, които съвсем дават отговор на опциите на най-хубавите модели в Съединени американски щати на дребна част от цената.
„ Има известна годност на теорията, че това може да тласне tokenmaxxing малко по-напред “, сподели Рафи Крикорян, основен софтуерен шеф на Mozilla. „ Но в случай че погледнем промишлеността като цяло, мисля, че тя осъзнава, че tokenmaxxing е неуместно нещо. “
Подобно е, сподели Крикориан, на метода, по който софтуерните компании в миналото са считали какъв брой реда код е написал програмистът за добър индикатор за продуктивност. По-късно това изпадна в недружелюбност.
„ Мисля, че tokenmaxxing се движи по безусловно същия модел “, сподели той. „ Мисля, че това ще бъде забавен миг, на който всички ще погледнем обратно, с цел да се посмеем след година. “