Мой чек-лист перед выкатом LLM-фичи в прод
Набил шишек, свёл в чек-лист. Делюсь. Лимиты на токены и таймауты; фолбэк-модель на случай 429; логирование промптов и ответов; фильтр PII на входе; отдельный бюджет-алерт; eval-на
Набил шишек, свёл в чек-лист. Делюсь. Лимиты на токены и таймауты; фолбэк-модель на случай 429; логирование промптов и ответов; фильтр PII на входе; отдельный бюджет-алерт; eval-на
Автор, технический лидер с опытом, делится наблюдением: работа с AI больше похожа на управление командой, чем на написание кода. Код предсказуем, AI — нет. Те же навыки лидерства (объяснять контекст, цели, давать обратную связь) работают при взаимодействии с моделями. Главное — не притворяться, что AI человек, а научиться чётко выражать намерения.
Разработчики массово просят LLM-агентов выдавать короткие, человеческие ответы (например, «как для людей с ADHD»). Но это ошибка: упрощение происходит ДО завершения работы, а не после — модель теряет детали, скрывает ошибки и не передаёт полную картину родительским агентам. Правильно: агенты общаются между собой точными данными, а «человечность» добавляется только на выходе.
Spotify запускает метки «AI Persona» для искусственных артистов и исключает их музыку из редакционных и алгоритмических рекомендаций. Платформа будет автоматически выявлять фейковые профили с фотореалистичными AI-аватарами и начнёт с самых популярных. Цель — не дать AI-спаму убить пользовательский опыт, но при этом не запрещать AI-инструменты для живых музыкантов.
Энтузиаст выпустил фикс для официального чат-шаблона Qwen 3.5–3.8, который ломает мультитёрн-диалоги, tool calling и управление reasoning. Новый шаблон добавляет переключение thinking on/off, поддержку llama.cpp и vLLM, не портит KV-кеш и работает с OpenAI API-форматом инструментов.
Биоинформатик Дина Тейлор из Детской больницы Филадельфии запустила проект dGTEx — первую базу данных о том, как работают гены в здоровых детских органах. Раньше детей считали «маленькими взрослыми», что приводило к опасным побочным эффектам лекарств. Теперь есть шанс создать терапии, которые не калечат растущий организм.
С сентября 2026 Google удаляет Assistant, оставляя только Gemini. Проблема: Gemini не умеет нормально делать hands-free звонки в Android Auto, проваливается в 90% случаев. Автор — опытный пользователь — больше не может безопасно звонить за рулём и вынужден отключать Android Auto или ждать светофора. Google даёт костыли для обычного режима, но с Auto не помогают. Это не глюк UX — это угроза жизни: в 2024 в США из-за отвлечённых водителей погибли 3208 человек, а теперь AI вынуждает снова смотреть в экран.
Разработчик вручную записал алгоритм умножения столбиком в веса трансформера, минуя обучение. Результат — 100% точность на числах до 12 знаков, когда GPT-4 и остальные топ-модели на семизначных числах падают до 0% успеха. Инструмент Torchwright компилирует классические алгоритмы в архитектуру Phi-3.
Учёные из Японии впервые создали живых самок-клонов из клеток самцов мышей, удалив Y-хромосому с помощью CRISPR-инструмента Y-CUT. Самки XO (с одной X-хромосомой) выросли здоровыми и фертильными, смогли дать потомство. Технология открывает путь к спасению исчезающих видов, когда остались только самцы, и может ускорить создание генетически модифицированных животных.
Маркетинг на пять рынков, у каждого свой язык, но единый голос бренда. Раньше — пять команд с разным стилем. Сделал один системный промпт с гайдлайнами голоса + примерами на каждом