Математика доверия к AI: можно ли формализовать истинность, обоснованность и надёжность утверждений модели
Исследователь хочет создать верификационный движок для проверки надёжности утверждений AI — не улучшать LLM, а математически доказывать, можно ли доверять её выводам. Вопрос: как формализовать «истину», «обоснованность» и «доверие» через теорию вероятностей, формальную логику, теорию информации или constraint satisfaction? Ищет математические основы для Trust Engine, а не философские рассуждения.