Модели OpenAI серии o1 — это новые большие языковые модели, обученные с помощью подкрепления для выполнения сложных рассуждений. Модели o1 думают, прежде чем ответить, и могут создавать длинную внутреннюю цепочку рассуждений, прежде чем ответить пользователю.В статье об ограничениях бета-версии, о том, как работает новая модель OpenAI, особенностях промптинга и других тонкостях. Читать далее
OpenAI создает свой чип Jalapeño: конец монополии Nvidia на инференс?SemiAnalysis выпустили разбор собственной аппаратной разработки OpenAI под кодовым названием Jalapeño. Пока все обсуждали закупки тысяч GPU Nvidia Blackwell, команда Сэма Альтмана совместно с Broadcom втайне проектировала специализированный ASIC на техпроцессе TSMC N3P, заточенный исключительно под инференс моделей масштаба GPT-4.5 и GPT-5. Читать далее
Команда AI for Devs подготовила перевод исследования OpenAI о контролируемости цепочек рассуждений в современных моделях. Авторы разбирают, почему наблюдение за CoT может быть ключевым инструментом безопасности, как масштабирование моделей и обучение с подкреплением влияют на контролируемость и какой «налог» приходится платить за более надёжный мониторинг. Читать далее
25 марта вышла новая модель Gemini 2.5 Pro от Google. Много уже было про нее сказано, но я стараюсь не обращать внимания на волны хайпа вокруг новинок, ориентируясь на свои доверенные источники. Одним из них является любительский бенчмарк SimpleBench, который тестирует здравый смысл в реальной жизни. Он интересен тем, что в нем самый обычный человек набирает 83.7%, а рекорд для LLM еще недавно был лишь 46.4%. Читать далее