Voice-бот для записи клиентов на локальной модели — полёт нормальный
Автоматизировал запись в барбершоп жены. STT (Whisper) → LLM с доступом к календарю → TTS. Клиент звонит, бот записывает. Крутится на одном сервере, стоит копейки против облачных г
Автоматизировал запись в барбершоп жены. STT (Whisper) → LLM с доступом к календарю → TTS. Клиент звонит, бот записывает. Крутится на одном сервере, стоит копейки против облачных г
DSpark — новый метод ускорения генерации текста большими языковыми моделями через спекулятивное декодирование. Система использует параллельную генерацию черновиков (как в DFlash), добавляет лёгкую последовательную голову для учёта зависимостей между токенами и применяет калиброванные оценки уверенности, чтобы верифицировать только те предложенные токены, которые действительно стоят вычислительных затрат целевой модели.
Энтузиаст обучил LoRA-адаптер для Krea 2 на RTX 5080 с 16GB VRAM вопреки популярным статьям, утверждающим, что нужно больше памяти. Полный тренинг 1152 шага занял 67 минут, пик VRAM — 93.8%. Бонус: разбор проблем официальных репозиториев (gated-доступ), bagов модели (bleeding в промпты без триггеров) и пошаговый рецепт с точными версиями библиотек.
Ant Group анонсировала Ling-3.0-flash, но вес-файлы ещё не открыты. SGLang обещает поддержку «в день релиза», vLLM ждёт публикации весов, а llama.cpp закрыл запрос на поддержку предыдущей версии (Ling-2.6) как «не планируется». Судя по паттерну предыдущих релизов, веса появятся после окончания бесплатного доступа к API — примерно 3 августа.
Apple выпустила iOS 26.6 — вероятно, последнее обновление перед iOS 27. Главная фишка: система заранее индексирует контент для новой функции Siri AI в Spotlight, чтобы поиск заработал мгновенно после обновления до iOS 27. Плюс 91 закрытая уязвимость.
JetBrains Research выпустил KotlinLLM — экспериментальный плагин для IntelliJ IDEA, который добавляет умные макросы: вызовы функций, чьё тело генерируется LLM во время работы программы. Если сгенерированный код не подходит, плагин останавливает выполнение, запрашивает у модели обновлённую версию и перезагружает класс через JDI. На тестах PetClinic: 24 из 24 сценариев отработали, хот-релоад прошёл со 100% успехом, оверхед около 1%. Работает только с Kotlin/JVM, требует IDEA 2025.2.x и JDK 21.
OpenAI обновил ChatGPT — теперь модель отказывается точно имитировать стиль конкретных писателей, как живых, так и умерших. Вместо копирования предлагает текст «в духе» автора, но с собственным голосом. Изменение заметили при тестировании с запросами на Стивена Кинга, Хемингуэя, Роулинг и других.
Губернатор Техаса объявил мораторий на подключение новых дата-центров к энергосети штата. Причина — взрывной рост спроса на мощности из-за AI-бума перегружает инфраструктуру. Регуляторы ERCOT проводят аудит всех проектов в очереди на подключение. Это первый громкий сигнал, что физическая инфраструктура не успевает за темпами развёртывания AI-железа.
Автор критикует попытки использовать большие языковые модели (LLM) как универсальное решение для всех задач бизнеса и инженерии. Несмотря на восхищение технологией, он объясняет фундаментальное ограничение: LLM работают только с языком как абстракцией реальности, но не моделируют физические процессы, причинно-следственные связи или реальный мир — они лишь статистически предсказывают следующий токен на основе текстовых паттернов.
Автор сгенерировал больше сотни продуктовых фотографий с помощью Stable Diffusion и поделился практическими находками: чисто белый фон сложнее, чем кажется (нужно указывать температуру света), отражающие поверхности порождают фантомные блики (используйте негативные промпты), масштаб критичен (добавляйте руки, предметы для сравнения), старые файн-тюны типа RealVisXL лучше новых моделей для продуктовой съёмки, а промпты нужно группировать по категориям товаров.