30 сентября Google продемонстрировала Gemini 4 Argon, первый за почти год свой флагман. В таблице самой Google он опережает GPT-6 Astra, Claude Opus 5.5 и Claude Fable 5.1 в 12 тестах из 18 и пишет миллион токенов за один ответ. Пока модель доступна лишь киберзащитникам из Fairwind. Разберемся, что в этом анонсе правда. Читать далее
Gemini 4 Argon вышел с таблицей, где он лидирует в 12 тестах из 18. Ровно такую таблицу Google показывала в феврале — для Gemini 3.1 Pro. Тот потом проиграл Claude в реальной работе больше чем на 300 очков. У релизов Gemini сложился сценарий, и Argon пока идёт по нему шаг в шаг. Дело при этом не только в Google: победа в бенчмарках сегодня значит всё меньше. Читать далее
Opus 5 не делает Fable 5 ненужным: благодаря вдвое более низкой официальной цене за токен, управляемому effort и близкому уровню возможностей Opus подходит как модель по умолчанию для большинства сложных задач, а Fable — как уровень эскалации для длинных, неоднозначных и дорогих в случае ошибки сценариев. Статья сравнивает цену принятой задачи, публичные рейтинги, работу с данными, fallback и доступ из России, а затем предлагает проверяемую двухуровневую схему маршрутизации. Читать далее
Вчера SpaceXAI выложила Grok 4.7. За три недели до этого OpenAI выпустила GPT-6 Astra, Anthropic — Claude Fable 5.1. Ещё в июле рядом встал Claude Opus 5: сама Anthropic пишет, что для большинства задач включать надо его, а Fable доставать, когда Opus уже не тянет ваши замеры.Китайские лаборатории…