Зелёный статус eval‑тестов ещё не гарантирует, что AI‑агент работает корректно: он может выдавать правильный ответ, но выполнять неверные действия или не выполнять их вовсе. В статье разбираем семь ошибок оценки AI‑агентов и показываем, какие подходы помогают измерять реальное качество системы. Разобрать ошибки
Пожалуй нет ни одной другой технологии сегодня, вокруг которой было бы столько мифов, лжи и некомпетентности. Врут журналисты, рассказывающие о технологии, врут политики которые говорят о успешном внедрении, врут большинство продавцов технологий. Каждый месяц я вижу…
Вы знаете, что большинство маркетологов врут на собеседовании и это почти норма ?Врут об опыте, результатах, кейсах, ошибках и достижениях. Виной тому, множество объективных причин. Я собираюсь выпустить цикл статей на эту тему, так что не стесняйтесь, подписываться на профиль,
14 ошибок TypeScript. Такой был результат моего первого промпта в ChatGPT, когда я попросил написать тесты для React-компонента.Через несколько месяцев тот же запрос "напиши тесты" выполняет мультиагентный пайплайн из 7 AI-агентов. Он сам планирует тест-кейсы, пишет код, проверяет его по…