
Современные ИИ-агенты сталкиваются с фундаментальной проблемой: при выполнении длительных многошаговых задач их контекстное окно быстро переполняется. Каждый новый шаг добавляет данные в журнал действий, и уже через несколько десятков операций модель начинает «задыхаться» от объема информации. Это приводит к замедлению работы, росту затрат на вычисления и, что критично, к деградации качества ответов.
Команда исследователей из Google и Университета Пердью предложила элегантное решение — метод SKILL.state. Вместо того чтобы хранить полную историю действий, агент теперь поддерживает только «актуальный срез» состояния: ключевые факты, текущий прогресс и данные, необходимые для следующего шага. Все лишнее отбрасывается, как только перестает быть полезным.
Результаты экспериментов впечатляют. На тестовой задаче из 200 шагов новый метод продемонстрировал точность 94%, используя всего 122 тысячи токенов. Для сравнения: традиционная суммаризация контекста показала лишь 84% точности, но потребила 6,17 миллиона токенов. Разница — в 50 раз! При этом SKILL.state не просто экономит ресурсы — он еще и работает точнее.
Секрет кроется в том, как организовано сжатие. Вместо грубой суммаризации (которая теряет важные детали) или полного хранения (которое раздувает контекст), система использует интеллектуальную фильтрацию. Она оценивает каждый элемент информации с точки зрения его релевантности для будущих шагов. Факты, которые могут понадобиться позже, сохраняются; все остальное — удаляется.
Такой подход особенно важен для реальных приложений: автоматизация бизнес-процессов, анализ больших документов, многоэтапное планирование. Чем длиннее задача, тем заметнее преимущество SKILL.state. Если для коротких операций экономия незначительна, то для длительных сценариев она становится критической.
Конечно, у метода есть и ограничения. Если агент внезапно столкнется с необходимостью вернуться к давно отброшенным данным, восстановить их будет невозможно. Но разработчики утверждают, что в 94% случаев такая потребность не возникает — и это приемлемый компромисс между полнотой и эффективностью.
В индустрии, где стоимость токенов напрямую влияет на себестоимость продуктов, 50-кратное сокращение — это не просто оптимизация, а смена парадигмы. Возможно, именно такие решения позволят создавать по-настоящему автономных агентов, способных работать часами без вмешательства человека и без взрывного роста затрат.




