Astra, Sol, Terra и Luna: что показали тесты на реальных задачах
Мы проверили Astra, Sol, Terra и Luna на настоящих задачах BulatLAB: расчётах, движении мяча, звуковых эффектах, сценах Godot и Blender и масштабе кораблей для «Последнего флота».
Главный результат оказался практичнее рейтинга: высокий уровень рассуждений расходует больше времени и токенов, но не гарантирует лучший ответ. Точные исходные данные, понятный критерий готовности и проверка в реальном проекте часто важнее дорогого режима.
В выпусках видно и ошибки. Модель может построить красивую сцену, но неверно передать масштаб; движение может выглядеть убедительно, но не соответствовать задаче. Поэтому результат нужно проверять в движке, на сайте и на целевых экранах.
Это ограниченный опыт от 5 сентября 2026 года, а не универсальный рейтинг моделей. Интерфейс и доступность моделей могут меняться.
🎬 Русская версия: https://www.youtube.com/watch?v=sQc2qUsX12s
🎬 English version: https://www.youtube.com/watch?v=LRGQEePTxMg
Что для вас важнее при выборе модели: хороший первый результат, скорость или меньший расход токенов?
English
We tested Astra, Sol, Terra and Luna on real BulatLAB tasks: calculations, ball motion, sound effects, Godot and Blender scenes, and ship scale for The Last Fleet.
The practical result matters more than a ranking. Higher reasoning effort can use more time and tokens without guaranteeing a better answer. Accurate source data, a clear acceptance criterion and testing inside the real project often matter more than an expensive mode.
The videos also show failures. A model can create an attractive scene with the wrong scale, or convincing motion that does not satisfy the task. Results still need to be checked in the engine, on the website and at the target screen sizes.
This was a limited test performed on September 5, 2026, not a universal model ranking. Model availability and controls may change.
🎬 Russian version: https://www.youtube.com/watch?v=sQc2qUsX12s
🎬 English version: https://www.youtube.com/watch?v=LRGQEePTxMg
What matters most when you choose a model: a strong first result, speed, or lower token use?
Главный результат оказался практичнее рейтинга: высокий уровень рассуждений расходует больше времени и токенов, но не гарантирует лучший ответ. Точные исходные данные, понятный критерий готовности и проверка в реальном проекте часто важнее дорогого режима.
В выпусках видно и ошибки. Модель может построить красивую сцену, но неверно передать масштаб; движение может выглядеть убедительно, но не соответствовать задаче. Поэтому результат нужно проверять в движке, на сайте и на целевых экранах.
Это ограниченный опыт от 5 сентября 2026 года, а не универсальный рейтинг моделей. Интерфейс и доступность моделей могут меняться.
🎬 Русская версия: https://www.youtube.com/watch?v=sQc2qUsX12s
🎬 English version: https://www.youtube.com/watch?v=LRGQEePTxMg
Что для вас важнее при выборе модели: хороший первый результат, скорость или меньший расход токенов?
English
We tested Astra, Sol, Terra and Luna on real BulatLAB tasks: calculations, ball motion, sound effects, Godot and Blender scenes, and ship scale for The Last Fleet.
The practical result matters more than a ranking. Higher reasoning effort can use more time and tokens without guaranteeing a better answer. Accurate source data, a clear acceptance criterion and testing inside the real project often matter more than an expensive mode.
The videos also show failures. A model can create an attractive scene with the wrong scale, or convincing motion that does not satisfy the task. Results still need to be checked in the engine, on the website and at the target screen sizes.
This was a limited test performed on September 5, 2026, not a universal model ranking. Model availability and controls may change.
🎬 Russian version: https://www.youtube.com/watch?v=sQc2qUsX12s
🎬 English version: https://www.youtube.com/watch?v=LRGQEePTxMg
What matters most when you choose a model: a strong first result, speed, or lower token use?
astra
sol
terra
luna
codex
chatgpt
bulatlab
ai-tests
gamedev
godot