Российские математики научили ИИ-модели обмениваться знаниями напрямую
Стартап Mostik разработал метод передачи знаний между ИИ-моделями без текстовых сообщений.
Математики из российского стартапа Mostik разработали способ обмена информацией между ИИ-моделями без использования текста. Вместо сообщений модели передают данные через математические значения, заложенные в их весах.
Этот подход позволяет крупным моделям передавать знания меньшим, значительно повышая их интеллектуальный уровень без длительного обучения с нуля.
Технология работает на уровне архитектуры нейросетей. Большая модель кодирует информацию в числовые параметры, а малая расшифровывает и применяет их. Метод ускоряет адаптацию ИИ для узких задач с ограниченными ресурсами.
Разработка может изменить подход к обучению ИИ. Вместо обработки огромных датасетов модели смогут получать готовые знания от более опытных аналогов, сокращая затраты на вычисления и энергопотребление.
Mostik пока не раскрывает детали алгоритма, но тесты подтвердили его эффективность. В ближайшие месяцы стартап планирует представить коммерческие решения для бизнеса.