Nvidia научила ИИ-агентов для программирования тратить почти вдвое меньше токенов

Nvidia научила ИИ-агентов для программирования тратить почти вдвое меньше токенов

Изображение: OpenAI

Исследователи Nvidia собрали систему SoL-Pi, которая почти вдвое сокращает расход токенов у ИИ-агентов для программирования, пишет The Decoder. Экономия идёт не от модели, а от обвязки: слоя управления между моделью и средой, который решает, как агент видит состояние задачи, выполняет действия и разбирает результат. Такая обвязка есть у Codex и Claude Code, и от неё во многом зависит, сколько стоит работа агента.

Систему собрали на основе обвязки Pi. Самый экономный вариант SoL-Pi тратит на 49% меньше токенов и набирает 93,7% результата Pi в тесте EdgeBench, а вариант с одним самым сильным приёмом обходит Pi на 5,3% и всё равно экономит. По оценке авторов, при нынешних ценах API экономия составляет от $8,75 до $13,50 в час по сравнению со штатными обвязками Codex и Claude Code.

Обвязку улучшал другой агент: он изучал журналы работы, предлагал изменения и проверял их на подготовленных задачах. Так появились четыре приёма. Например, правка кода и запуск теста объединяются в один шаг, и модель не приходится вызывать лишний раз. Длинные журналы ошибок сокращает более дешёвая модель, а отдельная проверка следит, чтобы важное при этом не потерялось.

У системы есть пределы. На 63 задачах Terminal-Bench 4 SoL-Pi решила 15, а Codex и Pi по 18, хотя обошлась примерно на четверть дешевле Pi. Настраивали её только на GPT-5.6 Sol: с Opus 5 экономия сохранилась, но приёмы срабатывали реже.

Сергей
Автор: Сергей
Пишу о кибербезопасности и информационных технологиях на простом и понятном языке
Комментарии:

Как мы обрабатываем данные: политика обработки персональных данных