Приложение Т—Ж
В нем читать удобнее
Взлет и падение токен­максинга: почему ком­пании сначала поощ­ряли использование ИИ​ сотрудниками, а потом стали ограничивать
Нейросети
5K
Сгенерированное изображение — Лев Переулков / Midjourney

Взлет и падение токен­максинга: почему ком­пании сначала поощ­ряли использование ИИ​ сотрудниками, а потом стали ограничивать

Живой разработчик снова выгоднее нейросети
56
Аватар автора

Катя Лебедева

адепт зарплатмаксинга

Страница автора

Внедрение ИИ должно было стать почти бесплатным способом ускорить разработку.

Компании рассчитывали, что нейросети помогут быстрее писать код, искать ошибки, отвечать на технические вопросы и собирать прототипы. Поэтому появился токенмаксинг — разработчиков поощряли пользоваться ИИ как можно больше. Но весьма быстро выяснилось, что это не только экономит время, но и создает новую статью расходов.

Разбираемся, чем обернулась ставка на массовое использование нейросетей.

Вы узнаете

Почему токены важны при использовании нейросетей

Токен — это часть текста или данных, которую нейросеть читает или генерирует. Это может быть фрагмент слова, кода или файла. Большинство коммерческих ИИ-сервисов считают стоимость именно в токенах — раздельно входящие данные, которые модель получила, и исходящие, которые она сгенерировала. Исходящие обычно стоят дороже.

Как нейросеть разбивает текст на токены. © OpenAI
Как нейросеть разбивает текст на токены. © OpenAI

Когда пользователь пишет нейросети «составь письмо», токенов тратится немного: модель читает короткий запрос и генерирует короткий ответ. На рабочие задачи вроде «проанализируй этот документ» или «найди ошибку в процедуре» нужно больше: модель получает не только сам запрос, но и весь контекст вокруг него — документы, переписку, строки кода.

В итоге токены тратятся на действия, большая часть которых пользователю даже не видна. Считается все: история диалога, прикрепленные файлы, данные из репозитория, если сервис получил к нему доступ, промежуточные запросы и результаты работы. Чем больше контекста нужно модели, тем дороже становится задача.

Отдельный случай — ИИ-агенты, то есть вполне самостоятельные приложения, которые сами ищут путь к решению поставленной задачи. Они могут читать файлы, вызывать инструменты на компьютере или в облаке, проверять результат, исправлять ошибки и снова отправлять данные модели. Чтобы решить одну задачу пользователя, нужны цепочки из десятков действий, и каждое из них расходует токены.

При этом пользователь не всегда заранее видит, сколько действий понадобится. Агент может уйти в цикл, несколько раз перечитать одни и те же файлы, перезапустить проверку или снова попытаться исправить ошибку. Если не выставлен лимит, итоговая стоимость проекта может стать бесконечно большой.

Например, сотрудник финтех-компании Slash таким образом якобы случайно потратил 80 тысяч долларов на разработку брейнрот-шутера, где надо убивать Тунг Тунг Тунг Сахура и скибиди-туалеты.

Вайбкодинг-игра, на разработку которой потратили десятки тысяч долларов

Как возник токенмаксинг

Сначала высокий расход токенов в корпорациях поощряли и даже превратили в метрику. Чтобы люди начали экспериментировать с нейросетями, в компаниях вводили внутренние рейтинги и дашборды, устраивали неформальные соревнования.

Например, в Meta* появился дашборд Claudeonomics, где отображалось, кто из сотрудников потратил больше всего токенов в Claude. По данным Fortune, за месяц у более чем 85 тысяч сотрудников компании суммарно ушло 60 трлн токенов, а лидер рейтинга потратил 281 млрд токенов. Если считать по публичным тарифам Claude Opus, запросы одного такого пользователя могли стоить компании больше 1,4 млн долларов.

Похожий лидерборд был и в Amazon. KiroRank ранжировал сотрудников по тому, как активно они пользовались ИИ-инструментом. Но рейтинг быстро закрыли: он поощрял людей делать не те задания, которые были важнее для работы, а те, что требовали больше токенов и помогали подняться в таблице. После этого старший вице-президент компании Дэйв Тредвелл попросил коллег не использовать ИИ просто ради факта использования ИИ.

Такой подход стали называть токенмаксингом — когда продуктивность сотрудника измеряется количеством токенов, которые он потратил на генерации в нейросетях. Разработчики сравнивали разные решения, загружали больше контекста, запускали несколько агентов одновременно. Игровые механики корпораций только добавляли азарта и вовлекали.

Сначала токенмаксинг выглядел почти рационально. Чем больше сотрудники экспериментируют, тем выше шанс найти полезные сценарии использования нейросетей. Но потом метрику по количеству потраченных токенов начали считать критерием продуктивности. И тогда сжигание токенов из способа решать рабочие задачи превратилось в самоцель.

Руководители компаний, главные сторонники токенмаксинга, стали признавать, что высокие расходы на ИИ не означают лучших результатов. Но они считали это действенным способом заставить сотрудников быстрее привыкнуть к нейросетям. Партнер Sequoia Capital Соня Хуан формулировала это прямолинейно: «Нам всем надо токенмаксить». По ее логике, часть компаний успеет перестроиться под новую технологию, а часть — нет.

Что не так с токенмаксингом

Проблема в том, что расход токенов стал выглядеть как самостоятельная ценность. Пока нейросетями пользовались точечно, это было не так заметно. Но с учетом масштабов ошибки стали обходиться очень дорого, в том числе из-за отсутствия оптимизации:

  • мощные и дорогие модели использовали и для простых задач, с которыми справились бы более дешевые;
  • в запрос загружали слишком много контекста на всякий случай — например, весь документ вместо нужного фрагмента, весь репозиторий вместо конкретного файла, длинную историю переписки вместо краткого резюме;
  • агентов запускали параллельно, чтобы они предложили разные решения, хотя часть работы при этом дублировалась.

Особенно дорогими оказались задачи, где ИИ работает не как чат-бот, а как агент. Исследователи показывали, что в программировании такие агенты могут тратить в тысячу раз больше токенов, чем обычный чат. При этом больший расход не всегда давал более точный результат.

Аналитическая компания Jellyfish сопоставила, сколько токенов разработчики потратили в первом квартале 2026 года и сколько изменений в коде довели до результата — то есть провели через проверку и добавили в рабочие проекты. У нижних 20% по расходу токенов на это ушло около 3 $ за квартал, в среднем на 11 пул-реквестов. У верхних 20% — уже 1 822 $ и 23 пул-реквеста. То есть результат вырос примерно вдвое, а расходы — в сотни раз.

Uber предположительно израсходовала годовой бюджет на ИИ за первые четыре месяца 2026 года. Президент компании при этом отмечал, что пока трудно увидеть прямую связь между ростом расходов на Claude Code и тем, что Uber стала выпускать больше полезных функций для пользователей.

Microsoft тоже начала сокращать расходы на сторонние ИИ-инструменты. Компания стала отменять большую часть прямых лицензий Claude Code и переводить сотрудников на собственный Microsoft Copilot.

Самый громкий пример — история про неназванную компанию, которая, по данным Axios, могла потратить 500 млн долларов на Claude за один месяц, потому что не поставила лимиты на использование лицензий для сотрудников.

Из-за высоких расходов от токенмаксинга стали отказываться: когда токены уходят на лишний контекст, параллельных агентов и красивые внутренние метрики, ИИ превращается в новую статью затрат.

Корпорации любят придумывать метрики. © Anthropic / Reddit
Корпорации любят придумывать метрики. © Anthropic / Reddit

Как проблемы корпораций коснулись и пользователей

Сначала стоимость токенов была проблемой корпораций. Обычным пользователям многие ИИ-сервисы давали ощущение почти безлимитного доступа при оплате недорогой подписки. Человек платил примерно 20 $ в месяц и не думал, сколько стоит каждый запрос. Можно было попросить нейросеть переписать письмо десять раз, разобрать длинный документ, проверить код или запустить агента на большую задачу — почти все укладывалось в лимиты по подписке.

Постепенно реальную стоимость работы нейросетей стали перекладывать на пользователей. Лимиты во всех тарифах ужесточили, самые дорогие задачи, вроде генерации видео, ограничили. Часть моделей в популярных подписках заменили более дешевыми. Пара примеров:

  • в Gemini с подпиской Plus можно создать два коротких видео в день, а картинки по умолчанию генерирует не продвинутая Nano Banana Pro, а более простая Nano Banana 2;
  • в Claude пятичасовой лимит запросов уходит менее чем за час активного использования даже для текстовых задач;
  • в ChatGPT после исчерпания лимита по подписке запросы перекидываются на мини-версии моделей, а для Codex и ChatGPT в Excel можно докупать кредиты отдельно;
  • GitHub Copilot с 1 июня 2026 года перешел на оплату по количеству использованных кредитов — никакого безлимита.

Раньше быстрый вопрос и многочасовая автономная сессия могли стоить для пользователя одинаково, а разницу покрывал сам сервис. Теперь использование мощных моделей стало гораздо дороже.

Что в итоге

  1. Идея токенмаксинга в том, что чем больше токенов тратят сотрудники, тем выше их производительность. Большой расход поощряли как способ быстрее приучить команды пользоваться новыми инструментами.
  2. Но работа нейросетей не бесплатная. Оказалось, что если давать сотрудникам безлимитный доступ к ИИ, они могут прожигать сотни тысяч долларов, не принося измеримой пользы.
  3. Компании отказались от токенмаксинга и начали сокращать расходы на нейросети — вводить жесткие лимиты или отказываться от сторонних ИИ-инструментов.
  4. Одновременно с этим лимиты на использование чат-ботов ужесточились и для рядовых пользователей.

Мы постим кружочки, красивые карточки и новости о технологиях и поп-культуре в нашем телеграм-канале. Подписывайтесь, там классно: @t_technocult

сервисыинтернетнейросети
Катя ЛебедеваЗаставляли ли​ вас на работе пользоваться нейросетями? Расскажите о своем опыте:
  • Рикки-Тикки-ТавиНе заставляли, но настойчиво рекомендовали. Бесило жутко что меня учат делать мою работу. Просто помешались все в компании, в основном менеджмент. Похоже на секту. В общем я не был против использования ллм никогда, но не в каждую дырку же это пихать. Особенно когда у нас, когда очень старый и запутанный энтерпрайз проект, в стадии трансформации, только пытаемся отпределить подходы и требования , тут надо не торопиться а хорошо все продумать чтобы потом можно было работать. Но нет, менеджерам жалко сейчас два - три дня условно потратить на проектирование, зато потом месяцами разгребать последствия это пожалуйста. Бесит.38
  • Андрей ЧевозёровИзмерять продуктивность разработчиков количеством токенов это просто вторая серия сериала про «измерять продуктивность количеством строчек» И по-настоящему поражает как вроде бы неглупые, образованные люди, успешные в корпоративных политических играх продолжают вестись на подобные метрики считая это правильным24
  • user1264440Рикки-Тикки-Тави, интересно, что за компания?)0
  • Рикки-Тикки-Тавиuser1264440, публично критиковать компанию не хочу, поэтому название не говорил бы, но для контекста это средняя по размеру международная компания, 20 тысяч сотрудников, акции на бирже торгуются , в сфере медицины7
  • ИгорьА всего то стоило руководителю компании спросить бесплатную версию ИИ правильно ли будет выставить KPI по объему используемых токенов. И модель сразу бы ему ответила верно к чему это все приведет. Но это все не ново. Поговорка даже такая есть, кто лоб может себе разбить просто когда богу молится. А таких господ и в глобальных корпорациях на руководящих постах хватает.9
  • Sergey AveryanovОни там не знали что ли, что за токены надо платить? А то выглядит как-то вот так: >Давайте мотивировать сотрудников тратить как можно денег! >А чо это они так дофига тратят?! Корпоративная шиза во всей своей красе. Это как если бы мне сказали, чтобы я с корпоративной кредитки тратил как можно денег пока покупки соответствуют политикам пользования этими кредитками, я бы например тупо накупил самого дорогого инструмента и был бы самый большой молодец.16
  • AlexanderХодили по рынку консалтеры по внедрению ИИ и таким подходом год назад примерно, последнее по списку но не по значимости -- откатки за каждый объем сожженных токенов __разработчиками___ начиная с N за год, если видосики генерить, то такое не считается)) Не откатки конечно, а реферальная программа. По факту получилась история о том как за откатки всосать себе весь софт всего мира.7
  • АлександрВ итоге ИИ экономически невыгоден. И то что они сейчас все сжирают просто деньги в никуда. Интересный такой вывод.6
  • sn1pejkeeeРикки-Тикки-Тави, у нас также, только менеджмент чуть выше в один момент начал считать деньги. И уже полетели головы за все "интересные" ИИ-решения.1
  • Андрей Фролов)))4
  • Рикки-Тикки-Тавиsn1pejkeee, я наверно плохой человек, но буду надеяться что и у нас полетят)3
  • Мама ПапаSergey, скорее, не рассчитали масштаб, который это примет И, справедливости ради, сегодня я не смогу сказать, сколько будет стоить через полгода на новом инструменте задача, которая сейчас тратит, условно, 100 000 токенов. То есть уровень создания какой-то функции, а не суммаризации письма. Может стоить 70к, так как оптимизируют модель и инструменты, а могут и выпустить новый в чём-то крутой интерфейс, но стоить это будет 150к. Так что даже те, кто правда пытался оценить и масштаб, и расходы, не могли не сесть во многом в лужу1
  • Андрей ФроловМама, на мой взгляд, он всё же переоценил возможности. С типовыми задачами, конечно, справляется, но как только задача становится более "хитрой", то проще самому написать.3
  • Лукьянов ТимурАндрей, но самое интересное в том, что количество токенов в плане умственной работы гораздо ближе к действительности. Это же, по сути, единица измерения того, сколько ллм думала. Вот только измерять нужно эффективность работы программиста, а не ллм. Осталось придумать как посчитать количество токенов для естественного интеллекта человека и как отличить, когда он думает по работе, а когда о своём личном.3
  • Кто? ПетровАндрей, "И по-настоящему поражает как вроде бы неглупые, образованные люди, успешные в корпоративных политических играх продолжают вестись на подобные метрики считая это правильным" Чтобы люди начали экспериментировать с нейросетями, в компаниях вводили внутренние рейтинги и дашборды, устраивали неформальные соревнования (с)1
  • МарусяРикки-Тикки-Тави, плюсую! Вечнотгтправляют меня к ИИ, будто это таблетка от всего, требуют его использовать. Просто абсурд, когда использование инструмента превращается в самоцель. Все равно что строителю в kpi часы использования электродрели ставить. А то что ИИ ерунду городит неэфыективную, если с ним торопить, никого не волнуют6
  • Ноченькав компании помимо клод кода используют API ключи, ревью пулл реквестов, автоматизируют CI, запускают агентов, которые ежедневно запускают тесты/мониторят логи/миллион всего ещё можно придумать. вот и набегает круглая сумма2
  • sn1pejkeeeРикки-Тикки-Тави, если что-то с треском провалится, то вполне возможно. Хайпожоры должны получить урок2
  • RonНоченька, я могу поверить в цифры тысячи в месяц если использовать тупо без подписки через API, где наценка x100. "ревью пулл реквестов, автоматизируют CI, запускают агентов, которые" вот это вообще не дорого про мониторинг миллиона логов это мне кажется странная штука есть масса способов индексировать это и те же агенты просто делают запросы, там минимальная нагрузка даже если представить что люди которые этим пользуются совсем на ТЫ с ии, что весьма странно было бы то потратить такие суммы нереально, для меня все же выглядит как байки или журналистские упрощения реальных обстоятельств)0
  • KirillУ нас на работе тоже сначала всех загоняли в чат-боты, заставляли писать отчеты через них. А потом урезали доступ, потому что начальство увидело счет за API. Теперь пишем ручками, как в старые добрые2
  • KirillРикки-Тикки-Тави, классическое "внедрение ради внедрения") Нужно же в годовом отчете написать, что компания передовая и использует ИИ9
  • KirillАндрей, это беда крупных компаний. Там никто не может оценить реальный вклад человека, поэтому придумывают дурацкие цифры, чтобы было что в графики вставлять4
  • KirillSergey, они просто поверили, что каждая потраченная копейка на ИИ принесет им доллар прибыли А ИИ вместо прибыли принес им только счета за сервера))8
  • LeberkasЛукьянов, ллм "думает" не так как люди. По моим наблюдениям, много токенов тратится как раз в случаях, когда человек решил совсем не думать: - выдача агенту слишком большого и/или плохо структурированного задания - использование дорогих моделей для простых задач Как правило, чем лучше человек подумает, тем лучше у него соотношение токенов к пользе. Но совершенно точно это не ведёт к большому потреблению токенов.3
  • Гусь лапчатыйВот вроде очевидно, что идиотская метрика, но менеджмент как в секте обработали: токены, токены, токены! Больше ИИ богу ИИ. Да без проблем, ваш бизнес – ваши правила. Я в топе, мне повышают зп и ставят в пример. Потому что заставить ИИ делать задачи неоптимально – это я запросто. Менеджмент доволен, инвесторы довольны, ИИ корпорации довольны. Смотрю, по окончанию 1 полугодия начали подозревать, что больше токенов не ведет к большей прибыли. Да ладно! :) С попкорном жду следующую метрику.3
  • LanelesНу, стори пойнты это как раз не такая бесполезная метрика, если её применять к одному человеку. Она как раз показывает сколько труда объективно внёс разработчик в единицу времени. А остальное - да, бесполезная чушь0
  • Мама ПапаАндрей, так хитрых задач на самом деле очень мало И даже в них собственно хитрой может являться какая-то небольшая часть, но всё остальное будет более-менее типовыми и совершенно обычными функциями. Как бы то ни было, но 90% разработчиков и правда либо перекладывают json, либо занимаются более тонкой разработкой систем, которые на более высоких уровнях будут перекладывать json К тому же написание кода через ИИ и вайбкодинг - очень разные вещи. Нормальный разработчик в любом случае понимает, что надо делать, и даёт инструкции гораздо сложнее, чем "напиши приложение" и "вот стэктрейс, поправь ошибку". Так что даже что-то, с чем с наскока ИИ не справляется, он легко делает, если ему естественным языком написать, что и как должно работать. Вот по такому описанию, которое дать проще, чем написать вручную, он может сделать почти всё, что угодно2
  • Евгений АнисимовТипичная история барыг - сначала подсадить на свой продукт, потом стричь купоны. Мс точно также захватывала рынок, в ход шло всё - взятки откаты. Теперь мс везде...1
  • Гусь лапчатыйАндрей, написать можно и иишкой, а продумать «что делать», если задача не типовая – однозначно кожаный мешок нужен. Даже Fable. Я уже как студенту на зачете всячески намекаю как можно сделать – нифига. Перебирает решения, которые уже существуют. Новое вывести – ни в какую.1
  • sn1pejkeeeLeberkas, по факту самое большое сжиралово токенов это промпты вроде "сделай мне это" и все. Ну или тикет из жиры кидают и ждут. Какой-то чел хвастался мне, что у него контекст в 500+к токенов все время и это круто. Никто не учит нормально работать(раз), форсят какие-то лидерборды(два), угрожают сокращениями(три). Кто бы мог подумать, что выйдет какое-то говно. Ну точно не стратеги из менеджмента, я согласен.1
  • sn1pejkeeeЯ, потому что у тебя крошечные контексты? Это разве не очевидно?0
  • user6423377Кучеры радуются, их не заменят... Первый аэроплан (прототип) пролетел 7 метров, первые автомобили были далеки от того, что сейчас едет по дорогам, да и первые компьютеры были не так компактны и функциональны, как нынешние. Но прогреса не остановить! Удивляет, как люди, считающие себя на острие прогресса, начинают плеваться когда он наступает, и перестают признавать объектианую реальность0
  • людмила ГилевскаяЭто говорит о бестолковости и лени программистов,ничего сделать сам не могу,везде использую им,вот и результат.0
  • Ronsn1pejkeee, а вы точно понимаете как это работает? когда у модели типа опус заканчивается контекст(а это надо постараться), она запускает очень дешевого субагента хаику, который делает компрессию предыдущего общения и инфы из заполненного контекта и еще может написать в файл мемори резюме по задачам. Это уточню вообще минимальные по затратам операции, по крайней мере в контексте тех цифр о чем тут идет речь.0
  • ЙцукенбергКто сказал, что падение?0
  • Ник ЗавадскиРикки-Тикки-Тави, > тут надо не торопиться а хорошо все продумать чтобы потом можно было работать Золотые слова, которые, по-моему, нынче актуальны ВООБЩЕ везде. Никто не хочет остановиться и подумать, нет времени, срок вчера, поднажали!4
  • sn1pejkeeeЯ, я прекрасно понимаю, о чем речь, намного больше, чем вы, уж поверьте Чем больше проект -> больше токенов гоняется в обе стороны -> быстрее выбирается лимит Я могу при желании выбрать весь лимит Макс подписки меньше чем за час на проекте. И никакой субагент никак не поможет0
  • Мама ПапаЯ, а вы там вообще видите где-то токены? Там лимиты, это вообще другое Подключение по АПИ. Mcp сервер. Нейросеть перекапывают файлы проекта и ищет в нём нужное. Либо это вообще агент. Агентов может быть несколько, над ними ещё парочка. И в таком сценарии Клод Макс улетел бы за пару часов, если бы его вообще можно было к такому подключить. Это вообще другая категория И даже чатом можно пользоваться по-разному. Бывает лёгкая работа, бывает тяжёлая, с mcp, огромным контекстом, инструментами и так далее. Мало что можно сказать кроме того, что у вас не очень тяжёлые задачи, даже если их много0
  • Мама ПапаЯ, это не наценка. Это примерно настоящая цена) И одновременно единственный способ запустить большинство настоящих инструментов для разработки, а не пользоваться окном чата, которое часто не в состоянии дать тот же результат0
  • Сергей МонеронТехнология умная, но глупое расходование энергии на рисование картинок и написание писем приводит в тупик.0
  • Турист0
  • Турист0
  • user6423377Рикки-Тикки-Тави, типичный карго-культ, и инструмент ради инструмента, характерные для всей российской айтишки. В своё время так же судорожно распиливали монолиты на микросервисы, и внедряли кубер туда, где хватило бы виртуалок. Ничего нового. Вообще, то что пытаются делать у нас - это локальная оптимизация при общей неэффективности всего процесса разработки. Тут надо пересматривать весь процесс при таких масштабных внедрениях.2
  • Ronsn1pejkeee, >"Чем больше проект -> больше токенов гоняется в обе стороны " вот у вас проект к пример 300 тыс строк кода, 600 файлов, а вам надо добавить фичу, которая заденет 10 файлов, как вы себе представляете действует модель? агент настолько примитивно работает что берет весь проект и каждый файл построчно загружает к себе в контекст?) выбрать лимит 5 часовой сессии подписки за 1 час я тоже могу представить как сделать, это будет очень тупой запрос, но можно постараться, только это все равно никак не бьется с цифрами про миллионы0
  • RonМама, а что за инструменты которые нельзя запускать с обычной подпиской и которые нужны при разработке?0
  • RonМама, вы точно клодом пользовались? вот буквально вчера через mcp в белендере по обычной подписке max работал) можно пример задачи, просто у меня ощущение что вы либо расчеты для запуска спутников делаете либо воркфлоу ии модели)0
  • sn1pejkeeeЯ, нет, не построчно. Но файлы в большом проекте имеют тенденцию ссылаться на другие файлы в разных модулях, которые образуют целую взаимосвязанную сеть. Все агенты любят затягивать в себя максимальное количество информации, чтобы не выдавать некогерентную чушь. Если правка сложнее пары строчек в конфигах, то это сожрет полно токенов. Я могу выжрать лимит не тупым запросом, а просто одной из моих стандартных задач. Я просто не использую ллм для всего. Чтобы жрать меньше токенов мы с командой написали уже тысячи строк md-файлов, которые агенты забирают первыми. Помогает, но лишь отчасти.0
  • Ronsn1pejkeee, зачем изобретать велосипед, используйте например codegraph, нейросетка делает пару запросов к уже проиндексированному проекту и получает все связи, находит точно места куда ей вклиниться, далее что-нибудь типа rtk который выдаст уже в более сжатом виде.0
  • baskavacanВообще больше похоже на то, что чем больше токенов тратит разработчик, тем меньше ценность этого разработчика. Нафиг он сдался, деньги ему платить, если за него всё делает ии? Насколько помню, смысл разработки ии техногигантами и был в том, чтобы снизить безумные косты на вконец охреневших этих вот "работаю в айти"0
  • Цветет гераньБез грамотной встройки AI в цикл производства ПО хоть обтраться токенов, останешься с кучей гавна в котором не разбирается никто0
Вот что еще мы писали по этой теме
Сообщество