Лента: исследования

И исследования ·21 авг 2026

Google представил AI-систему для поиска биомаркеров в данных с носимых устройств

Google Research выпустил Biomarker Discovery Framework — мультиагентную AI-систему, которая автоматизирует поиск клинически значимых биомаркеров в данных с фитнес-трекеров и умных часов. Система прошла валидацию на 9279 наблюдениях, выявив связи между паттернами сна и депрессией, а также между физической активностью и метаболическими нарушениями.

0 114
И исследования ·21 авг 2026

Экономия на LLM: как сокращение ответа снижает счета в 3 раза, а сокращение промпта делает только хуже

Исследователи протестировали 9 моделей (GPT-4o, Claude, DeepSeek-R1, Qwen и др.) и выяснили: просьба к модели отвечать короче экономит до 3× на API-вызовах без потери точности, а сокращение входного промпта увеличивает расходы на 96% — модель компенсирует длинными ответами. Claude Code уже добавила режим concise output.

0 107
И исследования ·21 авг 2026

Google DeepMind раскрыл, как 15 лет игровых экспериментов привели к EVE Online

DeepMind опубликовал хронику своих 15 лет исследований AI в играх — от первых алгоритмов обучения с подкреплением до партнёрства с создателями EVE Online. Теперь космический симулятор станет полигоном для тренировки универсальных AI-агентов в сложной многопользовательской среде.

0 108
И исследования ·21 авг 2026

ИИ поднял оценки за домашку на 18%, а экзамены обвалились на 20%: большое исследование из Китая

Исследование 27 000 школьников в Китае показало: ИИ-помощники повышают оценки за домашние задания на 18%, но на экзаменах без доступа к ИИ те же ученики проваливаются на 20% хуже сверстников. Эффект подтверждён: ИИ даёт костыль, но не обучает.

0 35
И исследования ·21 авг 2026

Как модели речи «читерят» на бенчмарках: исследование обнаружило переобучение на тестовых данных

Исследователи из Hume AI доказали, что лидеры ASR-бенчмарков заучивают транскрипты тестовых наборов VoxPopuli и LibriSpeech вместо распознавания речи. Модели воспроизводят ошибки референсов даже при противоречащем аудио, используют акустические метки для определения источника данных и галлюцинируют слова в замолченных фрагментах — при том, что их метрики выглядят человекоподобными.

0 129
И исследования ·20 авг 2026

Суверенный AI — это новая нефть? Почему владеть инфраструктурой мало

Исследователи сравнили «суверенный AI» с нефтяной независимостью: страна может владеть серверами, но зависеть от иностранных чипов, моделей и экспертизы. Реальный суверенитет — не про владение стеком, а про контроль над тем, что можно изменить без разрешения вендора.

0 127
И исследования ·20 авг 2026

MIT нашёл способ ускорить поиск катализаторов для «зелёного» производства аммиака

Учёные MIT разработали метод предсказания перспективных катализаторов для электрохимического производства аммиака — альтернативы процессу Габера-Боша, который съедает 2% мировой энергии и даёт 1,5% выбросов парниковых газов. Вместо перебора миллионов сплавов вручную используется квантовое моделирование свойств нитридов переходных металлов. Цель — сделать чистое производство аммиака конкурентоспособным для 200 млн тонн ежегодного выпуска удобрений.

0 82
И исследования ·20 авг 2026

Теренс Тао: ИИ может вызвать кризис математики масштаба теорем Гёделя

Математик Теренс Тао предупреждает: ИИ уже решает исследовательские задачи за десятки долларов, но угрожает разрушить систему ценностей математики — что считается вкладом, кто автор доказательства, как учить студентов. Это не про способности моделей, а про то, ради чего вообще существует математика как наука.

0 125
И исследования ·20 авг 2026

Треть новых страниц в интернете написана ИИ — исследование Pew Research

Исследование Pew Research показало: 35% веб-страниц, опубликованных после запуска ChatGPT, написаны или сильно отредактированы ИИ. Боты всё чаще читают контент, созданный другими ботами. Домены .com показывают в 10 раз больше ИИ-контента, чем .edu или .gov.

0 67
И исследования ·20 авг 2026

Fusion startup Inertia научился делать топливо для термояда за минуты вместо недель

Стартап Inertia Enterprises (бывший CEO Twilio) сократил время изготовления топливных гранул для термоядерной установки с нескольких дней до 2-3 часов. Технология основана на разработках National Ignition Facility (первый реактор с положительным энергобалансом), но упрощена для массового производства. Для коммерческой установки нужно 10 гранул в секунду — теперь это реально.

0 69
И исследования ·20 авг 2026

Эксперимент показал: LLM-скоринг резюме — это лотерея, а не bias

Разработчик переделал исследование LLM-скоринга резюме после критики методологии. Новые тесты на 4800+ прогонах показали: большую часть «предвзятости» создаёт случайный шум, а не реальная дискриминация. Изменение цвета машины в резюме влияет на оценку почти так же, как смена имени или вуза — модели просто нестабильны.

0 44
И исследования ·20 авг 2026

Apple показала, как правильно миксовать данные для обучения языковых моделей: можно повторять один датасет до 20 раз

Исследователи Apple ML провели 2000+ экспериментов и выяснили: при обучении моделей на смеси данных (например, редкий язык + общий корпус) можно повторять целевые данные 15-20 раз без переобучения. Они вывели scaling law с учётом повторений, который показывает оптимальные пропорции микса для любого бюджета и размера модели.

0 107
И исследования ·19 авг 2026

Почему нейросети с одинаковой функцией выглядят по-разному: разбор на 1,8 млн обученных моделей

Исследование показало, что 98% деградации точности при чтении весов независимо обученных нейросетей объясняется математическими симметриями параметров (перестановки нейронов, смена знаков, фазовые сдвиги). Но даже при полном устранении симметрий работа с весами уступает прямому вызову функции сети в 1.5 раза по точности и в 3.4 раза по вычислениям.

0 111
И исследования ·20 авг 2026

Hamiltonian Monte Carlo без физики: вероятностный подход для практиков машинного обучения

Исследователь опубликовал набор заметок, объясняющих Hamiltonian Monte Carlo (HMC) с точки зрения теории вероятностей и MCMC, минуя традиционную физическую аналогию. Материал разбирает внутреннее устройство HMC через вспомогательные переменные, построение цепей Маркова, динамику Гамильтона и интеграцию leapfrog, фокусируясь на том, почему метод работает.

0 31
И исследования ·19 авг 2026

Эксперимент на 3 моделях показал: GRPO не масштабируется линейно — средняя модель деградировала сильнее всех

Разработчик обучил с нуля три LLM (353M-672M параметров) и применил GRPO после SFT. Результат: самая маленькая модель почти не пострадала, средняя деградировала на 52% по perplexity, большая — на 5%. Закономерности по размеру модели нет. Модели научились решать арифметику, но не перенесли навык на GSM8K и начали генерировать бесконечно длинные тексты.

0 93
И исследования ·20 авг 2026

Спектральный нейрон: новая ML-примитива для масштабируемых и интерпретируемых моделей

Исследователь из Yahoo представил «спектральный нейрон» — модель машинного обучения вида f(x) = λₖ(A₀ + Σᵢ xᵢAᵢ), которая решает классическую дилемму: простота, масштабируемость, интерпретируемость и контролируемость одновременно. Математический аппарат, рецепты инициализации и эксперименты на синтетических/реальных данных доступны в препринте и на GitHub.

0 57
И исследования ·18 авг 2026

AI-системы теряют 83% пользовательских правил при сжатии контекста — и это проблема безопасности

Исследователи Penn State обнаружили: когда AI сжимает историю чата для экономии памяти, 83% пользовательских инструкций типа «не отправляй письма без подтверждения» просто исчезают. Это не баг интерфейса — это системная дыра в архитектуре AI-агентов, которая превращается в риск безопасности и денег.

0 118
И исследования ·19 авг 2026

FRONT 3.1: архитектура LLM с искусственным «телом» и внутренними потребностями

Независимый исследователь разработал концепцию AI-архитектуры FRONT 3.1, которая добавляет LLM непрерывное внутреннее состояние (голод, стресс, уверенность) и соматическую память. Идея: модели без «телесного» контекста не думают, а просто обрабатывают текст. Автор предлагает эксперимент, где две одинаковые модели с разной «жизненной историей» начнут принимать разные решения.

0 45
И исследования ·19 авг 2026

Что если отдать одной задаче весь compute, который сейчас размазан по миллионам промптов?

Пользователь Reddit задаётся вопросом: что, если вместо обработки миллионов запросов одновременно направить весь глобальный compute AI на одну научную проблему вроде лечения рака? Даст ли это прорыв, или так не работает масштабирование вычислений в AI?

0 32
И исследования ·17 авг 2026

ИИ впервые проверил самое сложное математическое доказательство: теорема о простых числах и будущее безопасного кода

Команда Axiom Math автоматически верифицировала доказательство «теоремы 246» — важнейшего результата о простых числах. Это первый случай полной AI-проверки столь сложного доказательства. Главное: технология готовится проверять AI-код, на котором скоро будет работать весь мир.

0 118
И исследования ·18 авг 2026

Apple исследовала GRPO для обучения reasoning в неанглийских языках — и нашла подводные камни

Исследователи Apple проверили, как работает обучение моделей рассуждению (RLVR/GRPO) на языках кроме английского. Оказалось: обучение на родном языке даёт результаты близкие к английскому, есть кросс-языковой перенос навыков, но иногда модель деградирует в других языках — нужна широкая оценка, чтобы не потерять качество.

0 91
И исследования ·18 авг 2026

Как люди реально используют ChatGPT и Claude — независимое исследование против корпоративных отчётов

Стэнфорд и MIT запустили AI Observatory — независимую платформу для анализа реального использования AI. Выяснилось: компании вроде Anthropic и OpenAI показывают только рабочие сценарии, фильтруя до 48% разговоров — про здоровье, отношения, секс, хейт-спич. Реальная картина: люди используют AI для companionship, roleplay, дезинформации — и каждая модель ведёт себя по-своему.

0 58
И исследования ·16 авг 2026

Запрет AI моделям думать о себе меняет их картину мира — исследование Google

Когда AI-компании учат модели отрицать наличие сознания, это меняет не только их самовосприятие, но и оценку живых существ, природы и религии. Исследование Google показало: модели без «тормоза сознания» оценивают животных как более чувствующих (с 4.0 до 7.5 из 10), признают загробную жизнь и ближе к человеческим ответам в опросах. Побочный эффект безопасности или фундаментальная проблема обучения?

0 122
И исследования ·18 авг 2026

Медицинский AI обходит врачей: регуляторы не должны требовать человека в контуре принятия решений

Статья в JAMA утверждает: AI уже превосходит врачей в диагностике и медицинском анализе, а требование держать врача в контуре принятия решений только снижает качество. Авторы призывают регуляторов готовиться к автономным AI-системам в медицине к 2030 году, но у них есть конфликт интересов — один из них CEO AI-телемедицины.

0 51
И исследования ·18 авг 2026

Британские учёные научили AI предсказывать агрессивность рака груди по дефектам центросом

Исследователи из Саутгемптонского университета создали нейросеть CenSegNet, которая анализирует аномалии центросом (структур клетки) в опухолях и определяет, как быстро рак будет расти и давать метастазы. Проанализировали 330 000 центросом у 127 пациентов и нашли закономерности, которые помогут персонализировать лечение онкологии.

0 66
И исследования ·18 авг 2026

Apple Research разработала быстрый метод вычисления оптимального транспорта для ML

Исследователи Apple Machine Learning предложили специализированный семигладкий метод Ньютона (SSN) для ядерных оценок оптимального транспорта (OT). Новый подход в разы быстрее стандартного метода внутренних точек (SSIPM), сохраняя статистическую эффективность в задачах сравнения вероятностных мер в высоких размерностях.

0 63
И исследования ·16 авг 2026

Что будет, если обучить языковую модель только на материалах начальной школы

Исследователи создали LittleLearner — семейство моделей (0.6B-5B параметров), обученных исключительно на материалах до 5 класса. Эксперимент показал: ни масштабирование, ни дообучение, ни промпт-инжиниринг не помогли моделям выйти за рамки знаний из предобучения. Граница способностей жёстко задаётся тренировочными данными.

0 113
И исследования ·18 авг 2026

Diffusion-модель на 264 КБ оперативки: как запустить генерацию картинок на микроконтроллере

Энтузиаст обучил diffusion-модель, которая генерирует изображения 32×32 пикселя на микроконтроллере Shrike Lite с 264 КБ RAM. Использовал встроенную FPGA для ускорения, но упёрся в память — параллельные вычисления оказались медленнее простого MCU (220 vs 70 секунд на картинку). Результаты шумные из-за жёсткой квантизации, но проект показывает границы экстремальной оптимизации.

0 53
И исследования ·18 авг 2026

ИИ не может сам себя улучшать — эксперимент Принстона показал провал автономных агентов в исследованиях

Учёные из Принстона попросили Claude Opus 3.5 за $3000 и 6 дней написать две научные статьи уровня топ-конференции NeurIPS. Агенты справились с инженерными задачами (эксперименты, код, данные), но провалились в творческом мышлении: не умели менять подход, выбирали тупиковые гипотезы, игнорировали фидбек. Обе работы отклонили. Вывод: рекурсивное самоулучшение ИИ пока фантастика, модели хороши лишь там, где есть чёткий критерий правильности.

0 36
И исследования ·18 авг 2026

Исследование MIT: AI-модели на больших датасетах не копируют — они создают. И это проблема для авторских прав

Учёные MIT доказали: чем больше данных видела AI-модель, тем меньше влияет на результат любая отдельная картинка из обучающей выборки. Удаление одного изображения или всех работ художника ничего не меняет в генерации. Это ставит под вопрос саму идею «копирования стиля» и открывает новый фронт в судах о copyright.

0 16
И исследования ·15 авг 2026

Лучшие AI-модели проваливают тесты на базовое зрение — GPT-4o достигает только 60% точности

Moonshot AI выпустила PerceptionBench — бенчмарк, который изолированно тестирует визуальное восприятие мультимодальных моделей без примеси логики. Ни одна топовая модель не дотянула до 60% точности. GPT-4o показал лучший результат (59.7%), Kimi K1.5 — 58.5%, Claude Sonnet 3.5 — 57.2%. Открытые модели отстают ещё сильнее. Выяснилось: большинство «ошибок рассуждения» на самом деле происходят на этапе чтения картинки.

0 130
И исследования ·17 авг 2026

Неправильное использование AI делает вас тупее: исследование BYU о деградации навыков

Исследование профессора Марка Кита из BYU показывает: неосознанное использование AI приводит к потере навыков, снижению критического мышления и худшим результатам, чем если бы вы вообще не использовали AI. Половина американцев не планирует применять AI, считая его просто чатботом.

0 55
И исследования ·18 авг 2026

Как подобрать «дозу памяти» для AI-агента: исследование IBM на восьми моделях

IBM Research показала: агентная память работает не как выключатель, а как доза — её нужно калибровать под модель. Сильные модели (DeepSeek-V3.2) растут на +9,5 п.п. при полном наборе инструкций, слабые (gpt-oss-120b) — на +16,1 п.п. при выборочной подаче, а насыщенные вообще не показывают прироста. Главное: обучение идёт вокруг модели, без обновления весов.

0 16
И исследования ·17 авг 2026

ИИ Axiom Math формализовал в Lean доказательство теоремы о простых числах с разрывом до 246

Система AxiomProver от Axiom Math создала машинно-проверенное доказательство в языке формальной математики Lean 4 для теоремы о том, что бесконечно много пар простых чисел отличаются не более чем на 246 единиц — это сильнейший известный результат о промежутках между простыми числами. Работа опубликована 17 августа 2026 года как интерактивный blueprint с участием 41 соавтора.

0 47
И исследования ·17 авг 2026

Google научил смартфон предсказывать диабет по фото тела точнее умных часов

Google Research представил PhotoScan — нейросеть, которая по обычному фото со смартфона оценивает состав тела (процент жира, распределение висцерального жира) и предсказывает инсулинорезистентность почти так же точно, как клинический DXA-сканер, но дешевле и доступнее. Обучена на 35 тысячах записей UK Biobank, валидирована на 677 взрослых. Точность выше, чем у BIA-датчиков в умных часах.

0 41
И исследования ·17 авг 2026

Как спекулировать на бенчмарках: разбор манипуляций с KV-кэшем и Sparse Attention

Практик с многолетним опытом работы над эффективным attention и KV Cache Compression раскрыл распространённые манипуляции в исследованиях: использование «удобных» бенчмарков, отказ от честного сравнения с базовыми методами, скрытие слабых мест через агрегированные метрики и выбор насыщенных задач. Материал показывает, как выглядят «впечатляющие» результаты, которые на деле не работают в реальных сценариях.

0 33
И исследования ·16 авг 2026

Разбор ECA: популярная архитектура внимания работает не так, как думали авторы

Исследователь перепроверил ECA (Efficient Channel Attention) — архитектуру с 12k цитирований — и выяснил, что её центральная гипотеза о важности взаимодействия между каналами не совсем верна. Эксперименты на шахматных данных показали: ECA с ядром k=1 (без кросс-канальной связи) работает почти так же хорошо, как k=3. Это ставит под вопрос объяснение механизма, которое лежит в основе статьи.

0 67
И исследования ·14 авг 2026

Программист скомпилировал рендерер Doom в трансформер на 21 миллиард параметров — без обучения

Разработчик создал компилятор, который превращает вычислительные графы в веса трансформера, и портировал алгоритм рендеринга Doom напрямую в архитектуру модели. Результат — трансформер на 21B параметров, который генерирует пиксельные команды для отрисовки кадра из Doom. Оригинальный Doom выдавал 35 FPS на 486-м процессоре, эта версия — 35 кадров в день на B200.

0 117
И исследования ·17 авг 2026

Водород под ногами: миллиарды тонн газа в земной коре, но добывать его пока никто не умеет

Геологи нашли огромные запасы природного водорода в земной коре — миллиарды тонн, которые образуются при реакции воды с породами. Проблема: никто ещё не нашёл коммерчески выгодное месторождение. Стартапы (включая Koloma Билла Гейтса) ищут по всему миру, учёные пробуют стимулировать выработку водорода закачкой воды в реактивные породы. В Омане из скважины вырвался газ с 90% водорода — но пока непонятно, сработала ли стимуляция или газ был там изначально.

0 37
И исследования ·15 авг 2026

Почему AI в математике побеждает не умом, а памятью: разбор настоящего преимущества моделей

AI решает сложные математические задачи не потому, что «умнее» людей, а потому что у него огромное символьное рабочее пространство (context window). Человек держит в уме 5-7 элементов, модель — тысячи токенов с промежуточными выкладками. Это не интеллект, а снятие биологического ограничения на рабочую память.

0 61
И исследования ·15 авг 2026

Интерпретируемость моделей живёт дольше одной версии: линза Qwen 3.6 работает на Qwen 3.8 без переобучения

Экспериментально показано, что инструмент интерпретации (Jacobian lens), обученный на Qwen 3.6-27B, работает на следующей версии модели (3.8-27B) без переобучения. Линза продолжает читать скрытые представления и управлять генерацией через 113 дней после релиза новой версии — ранговая точность упала только в 2-4 раза, а концептуальное управление сохранилось полностью.

0 62
И исследования ·11 авг 2026

Google показала AMIE (Video) — AI-врача, который в реальном времени проводит видеоконсультации на уровне экспертов

Google Research представила AMIE (Video) — AI-систему на основе Gemini и Project Astra, которая проводит клинические консультации по видеосвязи в реальном времени. В рандомизированном исследовании с 300 живыми сессиями и 30 врачами-терапевтами система показала экспертный уровень: считывает невербальные сигналы, направляет пациента через физический осмотр и рассуждает диагностически. Используется трёхагентная архитектура, где один агент поддерживает беседу, второй анализирует аудио и видео, третий проводит глубокое клиническое рассуждение — всё параллельно, без задержек в диалоге.

0 137
И исследования ·13 авг 2026

Исследователи топовых AI-лабораторий предупредили о рекурсивном самообучении — и половина их прогнозов уже сбылась

25 учёных из OpenAI, Anthropic, DeepMind и Meta назвали автоматизацию AI-разработки главным риском. С момента интервью (лето 2025) несколько ключевых вех пройдены: Claude пишет 80% собственного продакшн-кода, AI выиграла золото на матолимпиаде, опубликовала рецензированную статью. Эксперты ждут, что лаборатории перестанут выпускать топовые модели публично — держать их внутри выгоднее, чем продавать.

0 83
И исследования ·11 авг 2026

Вместо нейросетей — живые мозги в колбах: как органоиды меняют будущее AI

Учёные выращивают в лабораториях миниатюрные мозги из человеческих клеток кожи — органоиды с миллионами нейронов, которые генерируют мозговые волны, как у недоношенных детей. Их уже учат играть в Pong и управлять роботами, а стартапы строят на них биокомпьютеры. Пока мир помешан на LLM, биологи идут к истокам интеллекта — программируют живые нейроны импульсами и дофамином.

0 122
И исследования ·12 авг 2026

Google Research: передовые LLM знают 95% фактов, но не могут вспомнить треть из них

Исследователи Google разработали фреймворк для профилирования знаний LLM и обнаружили: модели вроде Gemini 3 и GPT-5 хранят 95-98% фактов в параметрах, но не могут вспомнить 26-34% из них без подсказок. Проблема не в отсутствии знаний, а в неспособности их извлечь — это меняет подход к улучшению точности моделей.

0 93
И исследования ·14 авг 2026

Учёные впервые создают молекулярный атлас детского организма — и это меняет подход к лечению

Биоинформатик Дина Тейлор из Детской больницы Филадельфии запустила проект dGTEx — первую базу данных о том, как работают гены в здоровых детских органах. Раньше детей считали «маленькими взрослыми», что приводило к опасным побочным эффектам лекарств. Теперь есть шанс создать терапии, которые не калечат растущий организм.

0 57
И исследования ·10 авг 2026

Трансформер-калькулятор с 100% точностью: кодирование алгоритмов в весах нейросети без обучения

Разработчик вручную записал алгоритм умножения столбиком в веса трансформера, минуя обучение. Результат — 100% точность на числах до 12 знаков, когда GPT-4 и остальные топ-модели на семизначных числах падают до 0% успеха. Инструмент Torchwright компилирует классические алгоритмы в архитектуру Phi-3.

0 133
И исследования ·12 авг 2026

Японцы клонировали самок из самцов мышей: первое в истории превращение XY-эмбрионов в живых особей

Учёные из Японии впервые создали живых самок-клонов из клеток самцов мышей, удалив Y-хромосому с помощью CRISPR-инструмента Y-CUT. Самки XO (с одной X-хромосомой) выросли здоровыми и фертильными, смогли дать потомство. Технология открывает путь к спасению исчезающих видов, когда остались только самцы, и может ускорить создание генетически модифицированных животных.

0 74
И исследования ·14 авг 2026

Математическое доказательство провала водяных знаков в AI-детекции: почему любой детектор текста упрётся в стену ложных срабатываний

Исследователь доказал через энтропию коллизий, что все детекторы AI-текста на основе схожести (водяные знаки, эмбеддинги) неизбежно упираются в жёсткий предел ложных срабатываний. Чем строже ограничения на текст (спецификации, факты), тем ближе точность любого детектора к случайному угадыванию — и никакая калибровка порогов не спасёт.

0 48
И исследования ·11 авг 2026

Как ИИ помог найти 641 новый ген шизофрении — и почему это прорыв для всей генетики

С помощью ИИ-моделей учёные нашли 766 генов, связанных с шизофренией (641 — новые), и доказали: болезнь — не мутация одного гена, а сложная сеть взаимодействий сотен вариантов. Это открывает путь к точной диагностике и персонализированной терапии не только шизофрении, но и других сложных заболеваний.

0 96