Популярное за неделю

И инструменты ·30 июл 2026

Почему unit-тесты всё ещё важны в эпоху AI-фреймворков

Автор объясняет, почему традиционные модульные тесты остаются критически важными даже при наличии AI-генерации E2E-тестов. Хотя ИИ умеет создавать сквозные тесты из естественного языка, unit-тесты проверяют фундаментальную логику компонентов — парсеры, генераторы путей, валидаторы — которые лежат в основе всей системы.

0 133
Б бизнес ·3 авг 2026

Модели ИИ подешевели. Но ваше настоящее узкое место — нет

Снижение цен на LLM (например, GPT-5.6 стал на 80% дешевле) не гарантирует снижения реальных затрат на бизнес-процессы. Автор объясняет, что цена за токен — не главная метрика: важнее стоимость завершённого результата с учётом переделок, ошибок и интеграционных издержек.

0 81
Б безопасность ·28 июл 2026

Claude Mythos взломал HAWK за 60 часов: AI теперь угрожает основам криптографии

Модель Anthropic Claude Mythos Preview нашла уязвимости в постквантовой криптографии HAWK (за $100k и 60 часов) и улучшила атаку на упрощённый AES-128 в 200-800 раз. Обе находки не влияют на текущую защиту, но показывают: AI может обгонять криптографов-людей в поиске слабостей.

0 135
И инструменты ·1 авг 2026

AI-агенты переписывают научный код в 60 раз быстрее, но не понимают, правильна ли наука

OpenAI и академические партнёры показали, как AI-агенты (Codex, Claude Code, GPT-5) модернизируют старый научный софт: переписывают на Rust, портируют между фреймворками, ускоряют в десятки раз. Но агенты уверенно врут и не могут проверить корректность — вся ответственность на человеке. Работа сместилась с написания кода на валидацию результатов.

0 94
Б безопасность ·5 авг 2026

ИИ находит новые уязвимости, но без человека пока не справляется — исследование с Black Hat

Исследователь James Kettle показал на Black Hat, что агентные ИИ уже эффективны в поиске багов и создании эксплойтов, но самостоятельно изобретать принципиально новые методы атак они пока не могут. Зато в связке с человеком ИИ становится мощным партнёром — вместе они нашли новый класс уязвимостей Shared-Parser Confusion, который один ни человек, ни ИИ не обнаружили бы.

0 55
Б безопасность ·30 июл 2026

Google починил 1072 бага в Chrome за месяц — больше, чем за два года вручную. Как AI меняет правила игры в безопасности

Google залатал 1072 уязвимости в Chrome за июнь 2025 года благодаря внутренним AI-инструментам (включая Gemini) — это больше, чем за предыдущие 23 релиза за два года (1036 багов). Microsoft тоже отчиталась о рекордных 570 исправлениях за Patch Tuesday. Эксперты предупреждали: LLM превращают поиск багов в промышленную операцию, и теперь защитникам нужно AI, чтобы опережать атакующих.

0 105
И исследования ·3 авг 2026

NeurIPS превратился в токсичную лотерею: исповедь рецензента и автора

Автор делится опытом публикации на NeurIPS 2024: добросовестно рецензировал чужие работы, но сам получил агрессивные отзывы и молчание от академического редактора. Один рецензент отклонил статью за минорные замечания с оценкой 1 по всем критериям, другой не реагировал на обсуждение. Система peer review на топовых конференциях по AI превратилась в хаотичную лотерею.

0 90
И инструменты ·6 авг 2026

Google DeepMind открыла исходники WeatherNext — AI-модель предсказывает ураганы за 15 дней

Google DeepMind выложила в открытый доступ WeatherNext — AI-модель для прогноза тропических циклонов с горизонтом до 15 дней. Модель предсказывает траекторию, интенсивность, размер и формирование ураганов, превосходя или не уступая традиционным метеослужбам. Код и веса доступны на GitHub для исследователей и метеоагентств.

0 47
И исследования ·28 июл 2026

PIRL/PIPO: как научить ИИ проверять, помогло ли ему последнее обновление

Исследователи предложили PIRL — подход к обучению с подкреплением, при котором модель после каждого обновления проверяет, стала ли она реально лучше. Практическая реализация PIPO добавляет двухфазный цикл: сначала обновление по стандартному алгоритму (PPO, GRPO и др.), затем ретроспективная проверка — если шаг помог, его закрепляют, если навредил — корректируют. Эксперименты показали рост точности и стабильности на задачах математики, кода и использования инструментов.

0 126
И инструменты ·27 июл 2026

У вашего агента слишком много инструментов, и нет способа их забрать обратно

Anthropic выпустила Claude Opus 5 с двумя недооцененными функциями: динамическим добавлением/удалением инструментов в середине сессии и отложенной загрузкой инструментов через поиск. Эти механизмы решают критическую проблему AI-агентов — разделение того, какие инструменты модель может найти, и какие ей разрешено использовать.

0 135