#инфраструктура

М модели ·21 авг 2026

Открытые модели догоняют за полгода вместо двух лет — что это значит для OpenAI и Anthropic

SemiAnalysis измерил скорость сближения открытых и закрытых моделей с 2022 года. Вывод: каждое поколение открытые модели догоняют вдвое быстрее. Llama-2 достиг уровня GPT-3.5 за 2 года, современные китайские модели (GLM 5.3, Kimi K3) приближаются к фронтиру за 6 месяцев. Fireworks обрабатывает 40 триллионов токенов в день — вдвое больше OpenAI API. Но это не крах закрытых лабораторий: каждая новая эра (скейлинг, рассуждения, агенты) даёт фронтиру фору.

0 25
И инструменты ·20 авг 2026

Bun 1.4 добавил Bun.WebView: автоматизация браузера встроена в рантайм

Вышел Bun 1.4 с Bun.WebView — встроенной автоматизацией браузера через WebKit/CDP. Саймон Уиллисон показал, как за пару минут собрать JSON API для скрейпинга с выполнением JS в 192-256 МБ RAM — альтернатива Puppeteer без лишних зависимостей.

0 113
Б бизнес ·17 авг 2026

OpenAI арендует крупнейший дата-центр в истории: Nvidia гарантирует до $105 млрд при общих обязательствах индустрии в $3 трлн

OpenAI заключила 20-летний договор аренды на дата-центр в Огайо мощностью 8 гигаватт под AI-расчёты. Nvidia даёт финансовую подушку до $105 млрд и становится эксклюзивным поставщиком чипов на первой половине объекта. WSJ выяснил: девять техногигантов (Google, Meta, Microsoft, Nvidia и другие) накопили ~$3 трлн AI-обязательств, которые не отражены в балансах — новый уровень риска.

0 86
И инструменты ·17 авг 2026

DeepSeek Harness: MIT-фреймворк для AI-агентов, где всё — плагин

DeepSeek выпустил v0.1 Harness — MIT-лицензированный фреймворк для сборки AI-агентов, где модели, инструменты, sandbox'ы и даже UI — это плагины на ядре Cordis. Всё меняется через конфиг без правки кода. Логирует каждую инъекцию контекста, работает с любыми провайдерами (DeepSeek, OpenAI, Anthropic, AWS Bedrock). Четыре режима запуска: от полного coding-агента до минималки для бенчмарков. Релиз для разработчиков инфраструктуры, не для готовых продуктов.

0 70
Б бизнес ·4 авг 2026

Google выводит $44 млрд рисков по чипам для Anthropic с баланса через сложную финансовую схему

Google организовала масштабную финансовую схему с Broadcom, Apollo, Blackstone и криптомайнерами, чтобы профинансировать продажу своих TPU-чипов Anthropic на $200+ млрд. Компания переносит риски на внешних инвесторов, оставляя на балансе только $815 млн из $44 млрд потенциальных обязательств. Вся конструкция держится на том, что Anthropic будет платить по лизингу и увеличит выручку в 20-30 раз к 2029 году.

0 134
И инструменты ·6 авг 2026

Cloudflare выпустила Kitesurf: браузер для AI-агентов без Chromium, который жрёт в 7 раз меньше памяти

Cloudflare запустила Kitesurf — браузер специально для AI-агентов, который работает в V8 изолятах на Workers без тяжёлого Chromium. Потребляет в 3-7 раз меньше CPU и памяти, чем обычный браузер, проходит 215 тысяч Web Platform Tests. Работает с существующими клиентами Puppeteer и Playwright — нужно добавить один параметр. Бесплатно в бета-режиме через Browser Run.

0 107
Б бизнес ·11 авг 2026

Nvidia гарантирует остаточную стоимость своих чипов ради $500 млрд инвестиций в AI-инфраструктуру

Nvidia договорилась с шестью финансовыми гигантами о привлечении $500+ млрд для AI-датацентров, фабрик и электростанций. Чтобы сделка работала, Nvidia гарантирует до 25% остаточной стоимости своих GPU — по сути, страхует кредиторов от обесценивания железа. Критики типа Майкла Бёрри считают быстрое устаревание чипов слабым местом всего AI-бума.

0 23
И инструменты ·9 авг 2026

Почему AI-агенты для кода не могут отлаживать продакшен: проблема наблюдаемости против генерации

AI-агенты умеют читать код и генерировать патчи, но в реальных системах баги часто связаны с окружением: упавшие сервисы, порты, таймауты, переменные. Автор предлагает сместить фокус с улучшения моделей на их интеграцию с observability-инструментами: логами, метриками, трейсингом. Вопрос — как правильно подавать runtime-данные в контекст агента и не дать ему действовать на основе неполной информации.

0 35
Б бизнес ·9 авг 2026

Nvidia и Amazon вкладывают миллиарды в энергетику для AI — и готовы жечь углерод

Nvidia инвестирует до $3 млрд в Lancium (энергоинфраструктуру для дата-центров OpenAI и Oracle), Amazon строит гигантскую газовую электростанцию в Техасе на 7,65 ГВт, которая станет самой грязной в США (33 млн тонн CO₂ в год). Энергопотребление AI растёт в разы — один heavy-пользователь агентной AI уже жрёт столько же, сколько сушилка для белья годами.

0 19
Б бизнес ·28 июл 2026

BlackRock покупает 80% кампуса Meta в Эль-Пасо: как мегакапитал зашёл в инфраструктуру ИИ

Meta продаёт 80% своего гигаваттного дата-центра в Техасе фонду BlackRock, оставаясь арендатором и оператором. Сделка закроется в ближайшие дни. Это первый крупный выход финансового капитала в инфраструктуру для обучения моделей — BlackRock покупает железо и энергетику, Meta арендует мощности.

0 106
Б бизнес ·4 авг 2026

Техас останавливает новые датацентры: губернатор требует аудиты на фоне энергетического коллапса

Губернатор Техаса Грег Эбботт заморозил все новые проекты датацентров до аудита регуляторами. Очередь на подключение к энергосети выросла с 233 до 474 гигаватт за полгода — это в 5 раз больше пикового потребления штата. 90% заявок — дата-центры Google, Microsoft и крипто-майнеров. Цены на электричество растут, сеть перегружена. Техас, долго считавшийся раем для AI-инфраструктуры, может закрыться.

0 42
И инструменты ·7 авг 2026

Cloudflare выпустил Kitesurf — браузер специально для AI-агентов

Cloudflare запустил Kitesurf — облачный браузер, заточенный под AI-агентов, а не людей. Он игнорирует визуал (темы, табы, расширения) и фокусируется на управлении контекстными окнами, производительности и токенах. Разработан за 12 недель, работает на серверлесс-платформе Workers, в бете доступен бесплатно. Цель: дать AI-агентам дёшево и эффективно ходить по вебу без костыля в виде Chromium.

0 25
И инструменты ·27 июл 2026

Kimi AI открыла AgentENV — систему для обучения AI-агентов на тысячах виртуальных машин

Moonshot AI (создатели Kimi) и kvcache-ai выпустили в открытый доступ AgentENV — распределённую платформу для обучения AI-агентов методом подкрепления. Система запускает каждого агента в изолированной микро-виртуальной машине Firecracker, умеет мгновенно сохранять состояние (снепшоты за 50 мс), клонировать окружения на лету и масштабироваться на кластеры. Используется для тренировки модели Kimi K3 с 2,8 триллионами параметров.

0 95
М модели ·30 июл 2026

Kimi K3: слишком велик, чтобы запустить

Автор провёл практический тест Kimi K3 — крупнейшей открытой модели с 2,8 трлн параметров и контекстом на 1 млн токенов. После 11 часов настройки кластера из 4×H100 и 594 ГБ весов выяснилось, что модель в 21 из 41 теста давала неверные ответы, включая полностью выдуманные данные при работе с длинным контекстом.

0 74
Б бизнес ·4 авг 2026

Техас заморозил подключение дата-центров к сети: инфраструктура не справляется с бумом AI

Губернатор Техаса объявил мораторий на подключение новых дата-центров к энергосети штата. Причина — взрывной рост спроса на мощности из-за AI-бума перегружает инфраструктуру. Регуляторы ERCOT проводят аудит всех проектов в очереди на подключение. Это первый громкий сигнал, что физическая инфраструктура не успевает за темпами развёртывания AI-железа.

0 28
Б бизнес ·21 июл 2026

ЦОДы США сожрут 20% электричества к 2035 году — и это консервативная оценка

BloombergNEF предсказывает, что дата-центры будут потреблять каждый пятый киловатт электроэнергии в США к 2035 году — это в четыре раза больше, чем сегодня. Виновник — бум AI-вычислений. Сети уже не справляются: в Виргинии и Техасе начался энергетический голод, цены взлетели на 76%, а один из крупнейших энергооператоров грозится выйти из региональной системы.

0 120
И инструменты ·21 июл 2026

Как я архитектировал SDAR на AWS и почему сознательно не запускал бенчмарки

Автор подробно разобрал алгоритм Self-Distilled Agentic Reinforcement Learning (SDAR) из свежей статьи, спроектировал полную архитектуру на AWS с расчётом инфраструктуры, но сознательно не стал арендовать GPU для бенчмарков. Вместо этого он честно объясняет цепочку инженерных решений: почему нужны четыре копии модели, как считать память под них, где sigmoid-гейт может дать NaN — и почему объяснение механизма важнее фейковой кривой сходимости.

0 121
И инструменты ·27 июл 2026

Дата-центры в космосе: бывший глава робототехники NASA объясняет, как это будет работать

Бывший руководитель подразделения NASA Роберт Амброуз рассказал, как космические дата-центры могут решить проблемы энергопотребления AI. Они будут питаться от солнечных батарей, сбрасывать тепло в космос, а на Землю передавать только данные. Главные препятствия — стоимость запуска (нужно снизить с $2900 до $500 за кг) и необходимость роботизированного обслуживания. Задержка связи составит доли секунды, пользователи не заметят разницы с наземными серверами.

0 93
И инструменты ·22 июл 2026

AWS Bedrock, SageMaker или EC2/Kubernetes для инференса LLM: как выбрать

Автор разбирает выбор между тремя AWS-подходами к развёртыванию LLM не как выбор одной платформы, а как систему из семи измерений (гибкость модели, латентность, модель затрат, операционная нагрузка, глубина кастомизации, комплаенс, зрелость команды). Главный тезис: большинство команд на масштабе в итоге используют два варианта одновременно, а инженерная ценность — в умении перемещать нагрузку между ними.

0 102
М модели ·27 июл 2026

Kimi K3 выходит сегодня: 1,4 ТБ весов и суровая математика GPU

Moonshot AI публикует веса модели Kimi K3 (2,8 трлн параметров, 896 экспертов MoE). Команда Qubrid разбирает требования к памяти: на A100 нужно 3 узла, на H200 — два, только B300 с нативной FP4 подходит для одного узла. Обещают тесты производительности на всех трёх конфигурациях к концу недели.

0 53
И инструменты ·30 июл 2026

Dili привлекла $21,7M на AI-комплаенс для инфраструктурного бума в США

Стартап Dili поднял $21,7M (Series A от Khosla Ventures) на автоматизацию compliance для строительных проектов — особенно тех, что получают федеральное финансирование. Используют LLM для извлечения данных из документов, а дальше детерминированная система проверяет соответствие сложным федеральным правилам (Davis-Bacon, IRA, OSHA). Уже работают на ~700 проектах — от дата-центров до заводов. Половина клиентов использует как SaaS, половина — outsourcing compliance целиком.

0 31
И инструменты ·23 июл 2026

Самая длинная подземная ЛЭП в Северной Америке застряла на старте

В мае открылась линия электропередачи CHPE длиной 545 км, соединяющая Квебек и Нью-Йорк — самая длинная подземная ЛЭП в Северной Америке. Она должна покрывать до 20% спроса Нью-Йорка на электричество из чистой гидроэнергии Квебека. Но за два месяца линия уже дважды отключалась, а трёхлетняя засуха в Квебеке ставит под вопрос стабильность поставок даже после устранения технических проблем.

0 43
М модели ·26 июл 2026

Kimi K3 — самая большая открытая модель в истории. Почти никто не может её запустить

Moonshot AI выпустила открытую модель Kimi K3 с 2,8 трлн параметров — крупнейшую в истории. Однако из-за огромного размера (1,4 ТБ весов даже в 4-битном квантовании) её практически невозможно запустить на собственном железе. Сама компания приостановила подписки из-за нехватки GPU для обслуживания спроса.

0 19
И инфраструктура и бизнес ·22 июл 2026

OpenAI раздует траты на инфраструктуру до $750 млрд: цена нового AI-бума

OpenAI увеличила прогноз капитальных расходов до $750 млрд к 2030 году — на 25% больше прежних оценок. Первый шаг — датацентр Project Camellia в Джорджии за $20 млрд, который потребует 3,2 ГВт мощности. Большая часть новых генерирующих мощностей придётся на природный газ, что вызывает вопросы об экологическом следе AI-индустрии.

0 35