Anthropic и OpenAI представили новые модели – мощнее прежних и дешевле в использовании
Индустрия ИИ последние месяцы обсуждает замедление темпов разработки и "удержание фронтира", но на планы двух крупнейших игроков это не повлияло. Anthropic и OpenAI почти одновременно обновили линейки своих моделей, сделав ставку не на радикальный скачок возможностей, а на снижение стоимости работы.
Обе компании развивают прошлые релизы, Fable 5.1 и GPT-6 Astra. Новые версии предлагают сопоставимый или чуть более высокий уровень производительности, но обходятся клиентам заметно дешевле.
Anthropic делает акцент на корпоративных сценариях. По заявлению разработчиков, Opus 5.5 лучше справляется со сложными задачами, поиском и устранением неэффективностей в программном коде, финансовым анализом и бизнес-задачами.
Внутренние тесты Anthropic показывают, что Opus 5.5 обошёл GPT-6 Astra в агентном программировании сразу на двух бенчмарках, Terminal-Bench 4.0 и FrontierCode v1.1 (Main). Для разработчиков это главный аргумент в пользу перехода на новую версию.
Изменения затронули и поведение модели. Anthropic утверждает, что Opus 5.5 пишет более понятные тексты, а попытки обойти установленные ограничения модель предпринимает примерно на 85 процентов реже, чем предыдущие поколения.
Цена на токены также снизилась. Обработка входных токенов обойдётся в 4 доллара против прежних 5, а выходных – в 20 долларов вместо 25 у Opus 5.
OpenAI, в свою очередь, обновила семейство GPT-6. Обе новые модели точнее работают с фактами, причём GPT-6 Sol, по данным компании, допускает примерно вдвое меньше ошибок, чем предшественник.
В программировании GPT-6 Sol выходит на уровень Fable 5.1, но при меньших затратах. Улучшенное кэширование запросов позволяет моделям переиспользовать больше контекста и быстрее выдавать ответы, а формулировки стали яснее.
По собственным тестам OpenAI, новые версии лучше соответствуют заданным принципам безопасности. В частности, они реже искажают результаты своей работы над кодом и чаще отклоняют попытки обойти защитные механизмы при потенциально опасных командах.
Параллельно OpenAI опубликовала собственные критерии для сторонних организаций, которые оценивают прогресс и безопасность разработки ИИ. Anthropic ранее выступала с похожими инициативами, однако превратятся ли эти предложения в единый отраслевой стандарт, пока неясно.
- Anthropic случайно слила 512 тысяч строк исходного кода Claude
- ChatGPT будет определять несовершеннолетних по поведению и требовать селфи для верификации возраста
- Пользователи ChatGPT начнут видеть рекламу