Поднял Recall@5 поиска по памяти на 17%, померил качество самих ответов и получил прирост, неотличимый от шума: тест Макнемара, p = 0.79. Месяц работы впустую. Потом посмотрел в промпт, поправил там одну формулировку и получил плюс 16 процентных пунктов за вечер. Модель отказывалась…
Токен, прочитанный из кеша, стоит не «немного дешевле». Он дешевле в 10–31 раз: DeepSeek — $0.44 против $0.014 за миллион, OpenAI — $4.00 против $0.40.Кеш провайдера — префиксное дерево по токенам. Он работает ровно до первого расхождения с прошлым запросом. Дальше — всё по полной цене.Поэтому одна…
Все хотят писать чистый код. Этому посвящены целые книги. Но вам не нужно читать книги, чтобы начать писать более чистый код прямо сейчас. Есть одна «хитрость», которой может научиться любой кодер, она делает код гораздо менее запутанным. Решение таково: Каждая строка делает только одно действие Одна строка, одна задача. Но не стоит слишком перебарщивать. Читать дальше →
Да, всех уже достала тема нейросетей, но для себя решил сделать некоторые тесты и поскольку разным людям они были довольно интересны, решил написать статью, суть простая, хочу сравнить на одном промпте (не самом простом) разные модели, у меня был доступ только к этим: Gemini 3 ProSonnet 4.5 ThinkingGPT 5.2 ThinkingGLM 5Qwen 3 Coder Next 80b (IQ4_XS квантование) (локальный запуск через llama.cpp) Промпт был для всех такой: Читать далее