Популярное за неделю

И инструменты ·6 авг 2026

Байесовская оптимизация моделей с Meta Ax: туториал по Client API для настройки гиперпараметров

Meta Ax — фреймворк для адаптивной оптимизации экспериментов. В туториале показано, как настраивать RandomForest через новый Client API: ограничения, многокритериальная оптимизация, работа с Парето-фронтом, сохранение экспериментов.

0 73
И инструменты ·12 авг 2026

Blacksmith вырос в 10 раз за год: почему тестирование AI-кода — новая золотая жила

Стартап Blacksmith привлёк $45M по оценке $550M (рост в 10 раз за год), помогая компаниям тестировать код, который AI генерирует слишком быстро. Уже 5000 клиентов, включая Mercury и Supabase, ARR — «десятки миллионов». Суть: AI пишет код быстро, но проверка остаётся узким местом — и это создаёт рынок.

0 17
И инструменты ·3 авг 2026

Кто-то создал бенчмарк для LLM в виде боксёрского матча: модели дерутся в реальном времени

Разработчик запилил необычный бенчмарк для языковых моделей — виртуальный бокс с уличными правилами. LLM получают данные о матче (плюс визуальный поток при наличии зрения) и принимают решения: атаковать, блокировать, уворачиваться. Автор меряет скорость реакции, адаптивность стратегии и корректность действий вместо классических тестов на решение задач. Модели Gemini Flash уже умеют уклоняться и контратаковать, локальные модели на 5060Ti тормозят из-за медленного инференса.

0 110
И инструменты ·1 авг 2026

Лимиты Claude Code: почему ваша подписка заканчивается до обеда

Автор столкнулся с тем, что его план Claude Code регулярно исчерпывался до полудня на обычных рабочих задачах. Расследование показало, что проблема не в количестве использования, а в структуре трат токенов — и детальный анализ JSONL-логов сессий раскрыл конкретные источники перерасхода.

0 118
И инструменты ·2 авг 2026

Kimi K3 (0.5 петабайта) запустили на одном CPU с 8 ГБ оперативки — голый C99, без GPU

Энтузиаст запустил гигантскую модель Kimi K3 (1.56 ТБ checkpoint) на обычном CPU с 8 ГБ RAM, написав inference-движок на чистом C99. Стриминг экспертов с NVMe, 4-битная квантизация без распаковки, 33 секунды на токен. Никаких фреймворков, GPU или BLAS — только OpenMP и 176 КБ бинарник.

0 116
И инструменты ·31 июл 2026

Разработчик обучил трансформер предсказывать уровень сахара в крови на 2 часа вперёд

Энтузиаст создал encoder-only трансформер на основе BERT, который прогнозирует уровень глюкозы у диабетиков на 2 часа вперёд, используя историю сахара, углеводов и инсулина. Модель обучалась на симуляторах и реальных датасетах (OhioT1DM, AZT1D, ShanghaiT1DM), крупнейшая версия — 17 млн параметров. Код и веса выложены под MIT-лицензией, есть версия для смартфона, работающая на личных данных автора.

0 128
И инструменты ·31 июл 2026

Трансформер для апскейла сжали до 668 КБ с помощью тернарной квантизации BitNet

Исследователи применили 1.58-битную квантизацию BitNet к vision-трансформеру Swin2SR для увеличения изображений. Модель весит всего 668 КБ в сжатом виде, работает в браузере и даёт +2.66 dB прироста качества над бикубической интерполяцией при увеличении в 2 раза.

0 130
И исследования ·1 авг 2026

Насколько симметричны внутренности нейросети для игры в Го: исследование KataGo

Автор KataGo (open-source бот для игры в Го) исследовал, как нейросеть внутренне представляет доску: учится ли она понимать игру независимо от поворота доски или запоминает паттерны для каждой ориентации отдельно. Правила Го полностью симметричны при вращении/отражении, но сеть этого не знает — только случайная аугментация данных при обучении. Один из выводов оказался неожиданным. Исследование написано с помощью AI, но под детальным руководством человека.

0 134
Р регулирование ·8 авг 2026

Дания вводит обязательную защиту письменных работ: как школы воюют с AI-списыванием

Министерство образования Дании обязало старшеклассников устно защищать все домашние письменные работы — борются с массовым использованием AI для списывания. Мера вступила в силу немедленно для ~9000 студентов выпускных классов. Параллельно школы внедряют мониторинг экранов на экзаменах и файрволы, ограничивающие доступ к контенту.

0 51
И исследования ·25 июн 2026

Эксперимент: температура 0 не делает модель детерминированной, и вот почему

Считал, что temperature=0 = один и тот же ответ. На проде получал расхождения на одинаковом вводе. Причина — недетерминизм на уровне железа/батчинга и floating point на GPU. Абсолю

0 319