Лаборатория Mira Murati работает над созданием ИИ-моделей с воспроизводимыми ответами

Лаборатория Mira Murati Thinking Machines Lab, получившая стартовое финансирование в размере 2 миллиардов долларов и собравшая команду из бывших исследователей OpenAI, привлекает большое внимание. В опубликованном в среду посте в блоге лаборатория впервые представила один из своих проектов: создание ИИ-моделей с воспроизводимыми ответами.

Проблема недетерминированности ИИ-моделей

В исследовательском посте под названием «Defeating Nondeterminism in LLM Inference» («Победа над недетерминированностью в выводе LLM») рассматриваются причины случайности в ответах ИИ-моделей. Например, если задать ChatGPT один и тот же вопрос несколько раз, можно получить широкий спектр ответов. В сообществе ИИ это считается фактом — современные ИИ-модели считаются недетерминированными системами. Однако Thinking Machines Lab считает эту проблему решаемой.

Новый блог лаборатории — Connectionism

Лаборатория запускает свой исследовательский блог Connectionism. Первый пост в блоге посвящён проблеме недетерминированности. Автор поста, исследователь Thinking Machines Lab Horace He, утверждает, что основная причина случайности в ответах ИИ-моделей заключается в способе соединения GPU-ядер — небольших программ, которые работают внутри компьютерных чипов Nvidia — в процессе вывода (всё, что происходит после нажатия клавиши Enter в ChatGPT). Он предполагает, что, тщательно контролируя этот уровень оркестровки, можно сделать ИИ-модели более детерминированными.

Преимущества детерминированных ИИ-моделей

Horace He отмечает, что создание более надёжных ответов для предприятий и учёных — не единственное преимущество детерминированных ИИ-моделей. Получение воспроизводимых ответов также может улучшить обучение с подкреплением (RL). RL — это процесс поощрения ИИ-моделей за правильные ответы, но если ответы немного отличаются, данные становятся немного «шумными». Создание более согласованных ответов ИИ-моделей может сделать весь процесс RL «более плавным», по словам He.

Планы лаборатории

Thinking Machines Lab сообщила инвесторам, что планирует использовать RL для настройки ИИ-моделей для бизнеса. Мира Мурати, бывший главный технический директор OpenAI, заявила в июле, что первый продукт Thinking Machines Lab будет представлен в ближайшие месяцы и будет «полезен для исследователей и стартапов, разрабатывающих собственные модели». Пока неизвестно, что это за продукт и будет ли он использовать методы из этого исследования для генерации более воспроизводимых ответов.

Thinking Machines Lab также заявила, что планирует часто публиковать посты в блоге, код и другую информацию о своих исследованиях, чтобы «принести пользу общественности, а также улучшить собственную исследовательскую культуру». Этот пост — первый в новой серии блогов компании под названием Connectionism — кажется, является частью этих усилий.

Источник: techcrunch.com

Авторизация