В официальном анонсе StepFun Step 5 Preview называют моделью для длительных агентных задач: программирования, работы с документацией, профессиональных исследований и финансового анализа. На этом фоне цифра в 600 млрд параметров выглядит эффектно, но куда интереснее другое число. При работе одновременно задействуется около 27 млрд параметров. Это примерно 4,5% от общего объема модели. Такая разница между полным и активным числом параметров возникает благодаря разреженной архитектуре MoE, где для обработки конкретного фрагмента данных подключается только часть специализированных блоков.
Практический смысл этой архитектуры уже виден в независимых измерениях. Artificial Analysis оценивает Step 5 Preview в 44 балла Intelligence Index при средней стоимости одной задачи около 60 рублей ($0,71). Claude Opus 5 в режиме максимальных вычислений получает 51 балл, но такая же задача обходится примерно в 493 рубля ($5,86). Заявление StepFun о примерно восьмикратной разнице в стоимости поэтому хорошо совпадает с опубликованными измерениями: разрыв составляет около 8,3 раза. При этом речь не идет о равных по возможностям моделях. У Claude выше общий индекс, AA-Briefcase, Terminal-Bench и ряд других результатов.
Есть и более показательное сравнение. Claude Opus 5 при среднем уровне рассуждений набирает 45 баллов, то есть находится почти рядом с результатом Step 5 Preview в 44 балла. Стоимость задачи у него при этом составляет $2,19 против $0,71 у StepFun, разница уже примерно трехкратная. В отдельных тестах картина меняется: например, Step 5 Preview получает 59% в SciCode против 52% у Claude Opus 5 Medium и 33% против 34% в Terminal-Bench 4.0. Поэтому один итоговый индекс здесь нельзя читать как универсальный рейтинг качества. Он полезен прежде всего для сравнения цены и совокупной производительности в одинаковой методике.
Step 5 Preview приблизилась к флагманским ИИ-моделям за восьмую часть их цены
StepFun вывела Step 5 Preview на рынок с результатом 44 балла в Intelligence Index. По независимому измерению одна задача обходится примерно в 60 рублей ($0,71), тогда как Claude Opus 5 с максимальным уровнем рассуждений набирает 51 балл при стоимости около 493 рублей ($5,86) за задачу.


Еще одна деталь требует аккуратной формулировки. В сообщениях о запуске Step 5 Preview уже называют одной из трех ведущих открытых моделей. Но сами веса 20 сентября еще не опубликованы. StepFun обещает выпустить их 15 октября, а Artificial Analysis на момент проверки помечает Step 5 Preview как proprietary и прямо указывает, что веса пока недоступны. Поэтому корректнее говорить о модели, для которой заявлено открытие весов 15 октября, а не о уже доступной open-weight модели. Лицензионные условия будущей публикации также имеют значение: само наличие весов еще не объясняет, насколько свободно их разрешат использовать и дообучать.

Контекстное окно заявлено на уровне 1 млн токенов, поддерживается ввод текста и изображений. Artificial Analysis также измерила скорость генерации около 100 токенов в секунду. Но для Step 5 Preview сейчас интереснее не предельный размер контекста и даже не 600 млрд параметров, а то, сколько вычислений модель расходует на получение результата. Связка из 27 млрд активных параметров и сравнительно низкой цены API дает StepFun сильную позицию именно там, где модель должна работать часами и выполнять длинные цепочки действий, а стоимость каждого следующего запроса начинает складываться в заметную сумму.
Открытие весов 15 октября станет второй половиной этой истории. До него Step 5 Preview остается доступной через API моделью с обещанием будущей публикации весов. Если StepFun действительно выпустит полный набор и не ограничит практическое применение жесткой лицензией, сочетание 600 млрд общих и 27 млрд активных параметров станет интересно уже не только покупателям API, но и тем, кто разворачивает модели на собственной инфраструктуре. Именно тогда можно будет проверить, насколько низкая стоимость облачного запуска переносится на самостоятельное развертывание.
Материалы по теме
- Edge0 держит 35B-модель в 2,9 ГБ активной памяти, выгружая экспертов на SSD
- [Writer](https://writer.com/blog/aug-roundup-new-at-writer/) выпустила Palmyra X6 и обещает снизить расходы на ИИ до 52%
- Android-приложения смогут передавать длительные задачи ИИ-агентам в облаке
- OpenAI вынесла инфраструктуру Codex в Agents API для разработчиков
- Strata запускает большую Qwen на игровом ПК, но с 8 ГБ видеопамяти есть оговорка