Один пользователь Claude пишет, что потратил больше миллиарда входных токенов. Другой оставил AI-агента без присмотра и насчитал около $6000 расходов. Цифры из Reddit стоит воспринимать осторожно, но проблема за ними реальная: длинный контекст обходится дороже, а иногда ещё и мешает модели нормально работать.
В мае на Reddit появился пост с довольно специфическим достижением. Его автор утверждает, что прогнал через Claude 1 156 308 524 входных токена, после чего решил поделиться тем, где именно они сгорели и какие привычки пришлось менять.
Чуть раньше там же появилась история болезненнее. Пользователь Claude Code настроил команду, которая каждые 30 минут проверяла открытые pull request, и забыл её остановить. За 26 часов цикл выполнился 46 раз. По его подсчётам, две разросшиеся сессии вместе обошлись примерно в $6000.
К самой сумме я бы относился осторожно. Это рассказ пользователя Reddit, а не подтверждённый биллинг Anthropic. Но техническая причина, которую он обнаружил в логах, заслуживает внимания. К концу одной из сессий автор оценивал накопленный контекст примерно в 800 тысяч токенов, и каждая следующая итерация снова работала с этой разросшейся историей.