Я дал 9B и 30B одну задачу. 30B сделал 24 шага и вернул неправильный ответ. 9B справился за 3. Разбираю почему размер модели — не главное, и что на самом деле определяет качество локального LLM-агента. Читать далее
Проблемы качества базы данных LLM[1] и необучаемости LLM в силу ограничения размеров контекстного окна сводятся к одной проблеме никак с LLM не связанной – оценке доверия к публикациям и их авторам вообще. Вторая проблема – LLM не умеет решать простые логические задачи легко решаемые
Что будем делать или что может быть интересного в статье:- Пайплайн из двух независимых LLM агентов- Запуск и анализ ошибки UI автотеста (Root Cause Analysis)- Фикс автотеста в цикле с его запуском.- Кастомизация MCP инструментов чтобы оптимизировать контекстное окно.- Система приоритетов в работе LLM агентов. Читать далее
Привет, Хабр! Меня зовут Владимир, и я давно хотел погрузиться во вселенную Warhammer40K. Для погружение во вселенную я решил обучить LLM на лоре Warhammer40K. И чтобы было интереснее, код этой LLM я решил написать сам, на голом pytorch (ну почти).Данная статья - первая в цикле статей по созданию и обучению GPT-like LLM с нуля. В них я постараюсь рассказать, как работают Decoder-only модели, как обучить небольшую LLM, сколько это заняло у меня времени. Читать далее