Бенчмарков сейчас – как нейросетей: каждую неделю новый. GPQA Diamond тестирует PhD-знания. Lexometrica проверяет фактическую точность. LLM Persuasion Benchmark – способность убеждать в дебатах. Chatbot Arena – предпочтения живых людей. Резонный вопрос: зачем ещё один?Два ответа. Первый:…
В апреле 2025 года OpenAI представила серию моделей GPT‑4.1 – сразу три версии: GPT‑4.1 (полноразмерная), GPT‑4.1 mini и GPT‑4.1 nano. Все они значительно превосходят предшественников (GPT‑4.0, также называемый GPT‑4o, и GPT‑4o mini) по качеству кодирования, следованию инструкциям и работе с…
Привет, это новый выпуск «Нейро-дайджеста» — коротких и полезных обзоров ключевых событий в мире искусственного интеллекта и технологий.Неделя насыщенная: релиз GPT-5.5 и Kimi K2.6, новая и самая крупная модель от DeepSeek, а ещё открытый Qwen3.6-27B. Пока GPT Images 2.0 обгоняет Nano Banana, Илон Маск…
Китайская компания Moonshot AI представила Kimi K3, и почти сразу лента заполнилась демонстрациями: браузерные игры, сайты, 3D-сцены, визуализации и проекты, собранные по короткому описанию.Я изучил Kimi K3 прежде всего с точки зрения практической разработки. Меня интересовало не только то, насколько эффектно выглядит очередное демо.Гораздо важнее для меня другое: Читать далее