И инструменты ·21 авг 2026 ·1 минИсточник

MLOps в больнице: как мониторить AI-модели под регуляцией MDR и EU AI Act

Больница в ЕС строит MLOps-платформу на своём OpenShift-кластере: собственные модели + вендорские, всё под требованиями MDR и EU AI Act. Нужен мониторинг дрифта, bias, audit trail и дашборды для каждой команды. Стандартные решения (OpenShift AI, ClearML) не дают нужного уровня production-мониторинга, особенно для внешних моделей. Думают допилить Evidently AI + Grafana.

0 74
И исследования ·21 авг 2026 ·1 минИсточник

Google представил AI-систему для поиска биомаркеров в данных с носимых устройств

Google Research выпустил Biomarker Discovery Framework — мультиагентную AI-систему, которая автоматизирует поиск клинически значимых биомаркеров в данных с фитнес-трекеров и умных часов. Система прошла валидацию на 9279 наблюдениях, выявив связи между паттернами сна и депрессией, а также между физической активностью и метаболическими нарушениями.

0 114
И исследования ·21 авг 2026 ·1 минИсточник

Экономия на LLM: как сокращение ответа снижает счета в 3 раза, а сокращение промпта делает только хуже

Исследователи протестировали 9 моделей (GPT-4o, Claude, DeepSeek-R1, Qwen и др.) и выяснили: просьба к модели отвечать короче экономит до 3× на API-вызовах без потери точности, а сокращение входного промпта увеличивает расходы на 96% — модель компенсирует длинными ответами. Claude Code уже добавила режим concise output.

0 107
И инструменты ·21 авг 2026 ·1 минИсточник

Официальный промпт-гайд Hailuo H3 работает хуже простого текста

Пользователь Reddit обнаружил, что рекомендованный формат диалогов для Hailuo H3 (`<d>[English]...<\/d>`) вызывает галлюцинации и добавляет лишние слова в речь персонажей. Простые кавычки работают идеально.

0 84
И инструменты ·21 авг 2026 ·1 минИсточник

Nvidia доказала: важна не модель, а «упряжка» агента — Claude Opus 5 набрал 100% на ARC-AGI-3

Nvidia показала, что для долгосрочных задач AI-агента важнее не сама модель, а «упряжка» (harness) — оболочка с памятью, инструментами и супервизором. Claude Opus 5 без неё дал 30% на бенчмарке ARC-AGI-3, с ней — 100%. OpenAI на том же тесте не дотянул до 10%, даже после твиков.

0 34
И инструменты ·21 авг 2026 ·1 минИсточник

RAG — решение проблемы, которой у большинства команд нет

Команды добавляют векторные БД и RAG при падении качества ответов, хотя реальная проблема — не в поиске информации, а в том, что модель не может выбрать из кучи релевантных документов действительно важный. RAG автоматизирует подачу того же мусора, не решая проблему приоритизации контекста.

0 91
Б бизнес ·21 авг 2026 ·1 минИсточник

Частный капитал вливает $100 млрд в AI-инфраструктуру: как устроена сделка Broadcom–Anthropic и почему это важнее, чем новые модели

Broadcom договаривается с частными кредиторами Blackstone и Apollo о $100 млрд на строительство AI-дата-центров для Anthropic — в 3 раза больше, чем аналогичный пакет 10 недель назад. Структура как ипотечные облигации: старший транш $60-70 млрд под залог железа, младший ~$30 млрд с повышенной доходностью и риском. Это первый крупный сигнал, что AI-капекс переходит на инструменты частного долга из-за масштаба и скорости, на которые не идут банки.

0 101
И инструменты ·21 авг 2026 ·1 минИсточник

AWS показал, как снизить расходы на RAG в Amazon Bedrock на 70% через сжатие контекста

AWS выпустил паттерн для RAG-приложений на Bedrock: маленькая модель (Claude Haiku) фильтрует контекст после поиска, оставляя только релевантные куски для основной модели (Claude Sonnet). Это даёт до 70% экономии на входных токенах при сохранении качества ответов. Реализация — одна Lambda-функция, работает с Bedrock Knowledge Bases.

0 50
И инструменты ·21 авг 2026 ·1 минИсточник

Ox Alpha оказался GLM-5.3 под капотом: независимый анализ раскрыл закрытую модель

Анонимный исследователь провёл цифровое дактилоскопирование модели Ox Alpha (доступной через OpenRouter) и обнаружил, что это на 99% GLM-5.3 от китайской Z.AI, просто с 75-токенным скрытым системным промптом. Доказательства: идентичный токенизатор, те же текстовые ошибки, побайтно совпадающие ответы при нулевой температуре.

0 112
И инструменты ·21 авг 2026 ·1 минИсточник

Sparse Attention для Minimax H3: до 70% экономии памяти и 2x ускорение генерации видео

Разработчик Zironic представил оптимизированную реализацию Sparse Attention для Minimax H3 с гибким контролем плотности внимания (10-50%), INT8/FP8 квантизацией и снижением пикового потребления памяти до 70%. В отличие от других патчей, работает только с видеотокенами и интегрируется с Comfy Kitchen напрямую.

0 85