Популярное за неделю

И инструменты ·1 авг 2026

Gemma 4 31B не может редактировать код: проблема точности при работе с файлами

Разработчик сообщает о систематической проблеме Gemma 4 31B при редактировании кода: модель постоянно ошибается в отступах и форматировании, из-за чего AI-инструменты отклоняют её правки. Проблема воспроизводится в разных системах (Goose, Copilot, Codex, Little Coder), несмотря на хорошие бенчмарки модели.

0 65
И исследования ·2 авг 2026

Основы ИИ: активационные функции и почему сети нужна нелинейность

Автор объясняет, почему нейронные сети без нелинейных активационных функций бесполезны: любое количество линейных слоёв схлопывается в одну матричную операцию и может проводить только прямые линии в пространстве признаков. Нелинейность (даже простая ReLU) ломает это ограничение и позволяет сети строить сложные границы решений.

0 68
И инструменты ·21 июл 2026

BGE-M3: модель эмбеддингов, объединяющая плотный, разреженный и мульти-векторный поиск

BGE-M3 от команды BAAI — это embedding-модель, которая впервые поддерживает три парадигмы поиска (dense, sparse и multi-vector retrieval) в одной модели. Раньше для гибридного поиска в RAG-системах приходилось разворачивать несколько моделей, что усложняло инфраструктуру. BGE-M3 упрощает архитектуру, сохраняя качество и гибкость.

0 129
М модели ·22 июл 2026

Cactus Hybrid: Gemma 4 научили признаваться, когда модель не уверена

Команда Cactus модифицировала Gemma 4, добавив слой из 68k параметров, который предсказывает уверенность модели в своём ответе (0-1). Это позволяет автоматически маршрутизировать только 15-35% запросов на большую облачную модель, достигая при этом качества Gemini 3.1 Flash-Lite. Ключевая фишка: зонд читает «самосознание» модели из скрытых состояний, а не из текста ответа или энтропии токенов.

0 119
И исследования ·27 июл 2026

Почему нельзя найти вектор правды в эмбеддингах LLM: парадокс Тарского в действии

Исследователи пытаются найти направление в эмбеддингах LLM, которое соответствует «правде». Но математическая логика доказывает: такой универсальный детектор истины невозможен — это парадокс самореференции, как у Гёделя и Тарского. Эксперимент на Qwen3.5-4B показал: на обычных фразах проба работает на 94%, на самореферентных («эта фраза ложна») — вываливается в nonsense.

0 87
М модели ·30 июл 2026

Почему AI теряет качество в длинных чатах (и как инженеры это обходят)

В длинных диалогах AI начинает забывать инструкции, противоречить себе и терять фокус. Причина не в «усталости» модели, а в архитектурных ограничениях: контекстное окно переполняется, а трансформеры хуже всего работают с информацией из середины контекста (эффект «lost in the middle»). Разные продукты по-разному решают проблему — обрезают историю, сжимают или извлекают релевантные части.

0 70
Р регулирование ·23 июл 2026

Почему аргументы против открытого AI — это чушь

Автор разбирает популярные доводы против open-source AI (особенно китайских моделей) и показывает, что попытки их запретить — это повторение ошибок с шифрованием в 90-х: не работает, вредит своим компаниям, а не конкурентам. Open-source AI — это не угроза, а двигатель экономики, как и любое другое открытое ПО.

0 122
Б безопасность ·23 июл 2026

Правительство отключило AI-модель на 19 дней. Почти никто не изменил свою архитектуру

Летом 2025 года США ввели экспортный контроль на продвинутые AI-модели Claude Fable 5 и Mythos 5 на 19 дней, полностью лишив тысячи команд доступа к критической зависимости в production. Китай рассматривает симметричные меры. Индустрия пережила инцидент и вернулась к прежней практике, не изменив архитектуру систем.

0 107
Б безопасность ·6 авг 2026

Как держать Claude Code в одном регионе AWS: гайд по data residency без компромиссов

AWS показал, как заставить Claude Code работать строго внутри одного региона (например, Лондона) для соблюдения требований data residency. Есть два пути: через новый Mantle endpoint (простой, но работает в 7 регионах) или через классический Amazon Bedrock с application inference profile (сложнее, но работает в eu-west-2). Оба варианта требуют IAM-политик с привязкой к региону и проверки через CloudTrail.

0 19
И инструменты ·25 июл 2026

Эмбеддинги и векторные базы данных: архитектура и компромиссы

Статья разбирает техническую архитектуру RAG-систем на уровне эмбеддингов и векторных баз данных. Автор объясняет, как превратить демо-прототип в production-ready решение, которое работает быстро и не съедает весь бюджет на инфраструктуру.

0 95