#надёжность

И исследования ·30 июл 2026

Как повторные запуски выявляют нестабильность, скрытую за единичной демонстрацией

Одна успешная генерация языковой модели не гарантирует повторяемости результата. Статья показывает, что даже при «детерминированных» настройках (температура=0, фиксированный seed) модели выдают разные ответы на идентичные запросы из-за особенностей API, численной точности и конфигурации инфраструктуры.

0 88
И инструменты ·15 июл 2026

Как мы научились строить AI-агентов на примере Shippy: архитектура для реальных решений

Команда Ai2 поделилась архитектурой морского AI-агента Shippy, который помогает аналитикам принимать решения в реальном времени. Главный урок: надёжность важнее модели. Агент состоит из трёх слоёв — «душа» (система промпт), навыки (markdown-файлы) и конфиг (LLM, фреймворк). Чтобы избежать ошибок, инструменты агента делают детерминированными: вместо прямых API-вызовов — CLI с типизацией и самодокументацией.

0 216