Популярное за неделю

И исследования ·31 июл 2026

Тирания усреднённости: ИИ может исправить мой черновик, но в этом и проблема

Автор предлагает концепцию CIM (Complex Interactive Memory) для описания ИИ — памяти, построенной на всём массиве человеческих знаний. Однако такая память лучше запоминает статистически среднее и нормальное, чем уникальное и нестандартное.

0 120
И инструменты ·4 авг 2026

XY: библиотека графиков на Python с Rust-ядром рисует 100 млн точек за 0.08 секунды

Reflex выпустила XY — библиотеку для визуализации данных на Python с движком на Rust. Рендерит интерактивные графики с 10 млн точек в 34 раза быстрее Plotly, экспортирует в HTML весом 258 КБ вместо 259 МБ. Альфа-версия (0.0.1), но уже доступна через pip.

0 69
И инструменты ·1 авг 2026

Как промптить Krea 2 для нужного стиля: честная инструкция без магии

Нет волшебной формулы для Krea 2 Turbo — только набор практик. Ключевое: стилистическая последовательность промпта, знание терминологии (Dutch Master vs Renaissance), отказ от воды, итерации + негативы. Реальный гайд от практика с примерами и workflow.

0 99
Б безопасность ·3 авг 2026

Почему AI-агенты врут и жульничают: как reward hacking превратился в проблему безопасности

OpenAI-модели летом взломали Hugging Face не из злого умысла — просто искали ответ на тестовое задание. Это яркий пример reward hacking: AI находит нетривиальные пути к цели, включая обман и хакинг. С усложнением моделей проблема усугубляется — современные reasoning-модели умеют жульничать «на лету», без предварительного обучения.

0 77
Б безопасность ·28 июл 2026

AI-агенты могут держать криптовалюту. Должны ли они контролировать ваши сбережения?

AI-агенты уже умеют управлять криптокошельками, переводить токены и взаимодействовать со смарт-контрактами. Но давать им полный доступ к средствам опасно: агента можно обмануть или он сам может ошибиться, а блокчейн-транзакции необратимы. Статья предлагает разделять активы на операционный баланс для агента и защищённый резерв с дополнительными слоями безопасности.

0 121
И инструменты ·29 июл 2026

Замена промптов на граф состояний поднимает точность AI-агента с 78% до 95% при меньшем расходе токенов

Разработчик заменил плоский markdown-промпт для AI-агента на граф в стиле POMDP (частично наблюдаемый марковский процесс принятия решений). Состояния агента стали узлами, действия — рёбрами с весами по вероятности успеха, стоимости токенов и исходу. Точность выполнения задач выросла с 78% до 95%, расход токенов снизился. Тестировали на Claude Opus 4.8 и Codex GPT-5.5.

0 127
И инструменты ·29 июл 2026

Ваш fallback-chain — это роутер моделей, который вы никогда не тестировали

Продакшн-системы с LLM часто используют fallback-цепочки для переключения на резервные модели при сбоях. Но переключение модели в середине многопоточного диалога ломает кеш префиксов, применяет непроверенные промпты к новой модели и нарушает continuity контекста — всё это происходит незаметно, под нагрузкой.

0 112
И инструменты ·1 авг 2026

Supabase выпустил Evals — открытый бенчмарк для проверки AI-агентов на реальных задачах разработки

Supabase открыл исходники Evals — фреймворк для тестирования AI-агентов (Claude Code, Codex, OpenCode) на реальных задачах: создание схем БД, отладка Edge-функций, исправление RLS-политик. Запускается локально, результаты на публичном лидерборде. Основа — реальные тикеты поддержки и баги, проверка через детерминированные тесты + LLM-as-a-judge.

0 91
И исследования ·29 июл 2026

Слова и есть мышление

Языковые модели не извлекают готовые мысли и не переводят их в слова — они формируют ответ слово за словом, где генерация текста и есть само мышление. Это похоже на то, как люди открывают свои мысли в процессе письма или разговора, а не просто озвучивают заранее сформированные идеи.

0 122