Задача звучит просто: выяснить, называют ли бренд ChatGPT, Claude, Perplexity, Gemini, Алиса AI и GigaChat, когда пользователь спрашивает совета или ответа у ИИ. На практике эта задача раскладывается на десятки технических решений, каждое из которых меняет результат в разы. Ниже устройство замера, формат хранения и три моих ошибки, которые обесценивают всю работу. Читать далее
Анонс The Elder Scrolls 6 состоялся в далеком 2018 году, но игра-по-прежнему находится в активной стадии разработки. А значит, чтобы вернуться на Тамриэль, нужно запускать старый-добрый Скайрим, которому в ноябре исполнится уже целых 15 лет. Благодаря активному фанатскому сообществу и…
12 августа Сбер выпустил своего первого универсального ИИ-агента. Новость эта стала федерального уровня, т.к. про неё написал ТАСС! Более того, было заявлено, что это “первый в России автономный универсальный ИИ-агент”. Как основатель компании, которая запустила ИИ-агентов в…
Уолтер Шлосс в течение 44 лет опережал индекс S&P 500 примерно на 5% в год. Он зарабатывал, покупая акции, которые большинство инвесторов бы проигнорировало. Это и есть стоимостное инвестирование. При таком подходе инвесторы ищут статистически дешёвые акции. Стоимость таких бумаг…
Уже второй сезон я строю дом. На этапе подведения коммуникаций появилась идея сразу проложить оптику от провайдера, чтобы потом не курочить стены. Сказано — сделано. Подключив пустую коробку к Интернету, я сразу задумался о том, что это отличный испытательный полигон для разных
Всем привет и добро пожаловать в подкаст Mindscape. Я ваш ведущий, Шон Кэрролл, и, хотите верьте, хотите нет, это уже 200-й обычный выпуск Mindscape. Я решил посвятить сольный эпизод определенному кругу вопросов, которые как раз относятся к натурфилософии в этом смысле - к области на…
Если вы замеряете прогресс своего солвера на случайной подвыборке из train, вы замеряете его не на том наборе. Медианная задача train занимает 100 клеток на выходе, у медианной задачи eval их 225. Два и более тестовых входа требуют 6.9 процента задач train и 40.8 процента задач eval. Расхождение…
Две зрелости – внедрения ИИ и его защиты – почти никогда не совпадают, и именно зазор между ними даёт большинство инцидентов и претензий регулятора. В статье приведём обе оси к единой шкале CMMI, покажем, как организации проходят узнаваемые состояния (от отрицания до бесконтрольных агентов), и свяжем всё это с Приказом ФСТЭК № 117 и российскими стандартами. Читать далее
Раньше инженера растили на задачах, которые сейчас называют «рутиной»: написать автотесты, собрать первичную аналитику, разметить датасет или составить документацию. Эта черновая работа была естественным тренировочным полем. Пробираясь через нее, новичок совершал…
Привет, Хабр! Испытания интересующих многих соотечественников аккумуляторных батарей Camel продолжаются. Мы сравниваем их параметры со старыми знакомыми АКОМ, прекрасно показывающими себя в течение многих лет.Все аккумуляторы АКОМ снабжены пробками для доступа к электролиту, куда при необходимости всегда можно долить дистиллированную воду. Camel не предоставляет такой возможности, поэтому тема сегодняшнего эксперимента представляет особую актуальность. Читать далее