Полгода назад в нашем продукте был один автотест. Сейчас их 878, и заметная часть написана командой ИИ-агентов. Рассказываю, как устроен харнесс из специализированных ролей, почему новый инструмент не попадает в него без RED/GREEN-доказательства пользы, и почему в системе, где код пишут агенты, самой дефицитной компетенцией оказывается тестирование. Читать далее
Какой кодер, такой и result, друзья. При проектировании эксперимента мы тестируем разные архитектуры. В прикладном применении нам важен выход и побочные характеристики (скорость, поддержка фреймворками, современном), а вот в теоретическом — мы пробуем найти интересный результат.Как не найти результат там, где его нет, сравнивая модели разных архитектур? Что существует в архитектуре по её определению? Этим чудесным вопросам и посвящена статья. Читать далее
Корпоративный ИИ постепенно выходит за пределы диалогового окна. Чтобы языковая модель приносила пользу бизнесу, ей недостаточно уметь отвечать на вопросы. Она должна получать разрешенные данные из информационных систем, работать по заданному сценарию и выдавать результат,…
Один из факторов роста рынка ГОСТ VPN – необходимость замены зарубежных криптошлюзов и перехода на отечественные решения. Для распределенных организаций такая миграция редко сводится к простой замене одного устройства на другое: нужно сохранить связь между десятками и сотнями
Предлагаю вашему вниманию обзор профессионального длиннофокусного зум-объектива топ-класса для зеркальной системы Four Thirds (4/3), выпущенного в октябре 2007 года. В эквиваленте полного кадра диапазон фокусных расстояний 100–400 мм. Объектив позиционировался для съёмки репортажей,…
В истории бизнеса есть патентные войны, которые меняли целые отрасли. Противостояние Pampers и Huggies — одна из них: борьба за эластичные манжеты, суперабсорбенты и другие инженерные решения продолжалась почти десятилетие. О «войне подгузников» — рассказываем в нашем материале. Читать далее
Служба каталогов Active Directory Domain Services, к сожалению, достаточно часто недооценивается бизнесом или ИТ-персоналом с точки зрения её критичности. Она представляет из себя не просто базу данных пользователей - а целый набор информационных систем, компрометация которых даёт…
Решил посчитать, сколько раз языковые модели отзываются плохо о конкретной компании. Вроде простая задача: прогнать запросы через несколько моделей, разметить тональность ответов, поделить негативные на общее число. У меня получилось три негативных ответа из 358 — 0,8%. Число…
Кэшировал агентный цикл ИИ‑триажа в своём security‑гейте — 80% входных токенов из кэша, ≈ 61% экономии. По пути нашёл 4 реальных бага, читая сырой вывод модели, вместо того чтобы верить цифрам в отчёте. Читать далее
Бывает так: код хороший, задачи закрыты, к технической части претензий нет. Но и повышения тоже нет. Или идею не взяли. А на интервью — отказ без внятной причины.Каждый раз я понимал, что дело не в инженерных скиллах. Только понимал медленно — на каждый такой инсайт уходили месяцы и годы. И стоило разобраться с одной ситуацией, как наваливалась следующая, где работал совсем другой механизм. 7 уроков