USD87.45EUR98.33RUB1.02
24.kg

DeepSeek хочет повысить эффективность ИИ за счет механизма вознаграждения

Бактыгуль ОСМОНАЛИЕВА
23:38, 08 апреля 2025, Бишкек - 24.kg

Китайский стартап DeepSeek, получивший известность благодаря своей рассуждающей ИИ-модели R1, анонсировал новый метод обучения, обещающий значительное увеличение эффективности искусственного интеллекта. Совместно с исследователями из университета Цинхуа DeepSeek опубликовал статью, раскрывающую детали инновационного подхода к обучению моделей посредством позитивного подкрепления результата, сообщает издание SCMP.

Разработанный метод нацелен на улучшение соответствия ИИ-моделей человеческим предпочтениям. Он использует механизм вознаграждения, стимулирующий генерацию более точных и понятных ответов. Обучение с подкреплением уже доказало свою пользу в узкоспециализированных задачах, однако его эффективность снижалась при применении к более общим задачам. Команда DeepSeek предложила решение, объединив генеративное моделирование вознаграждения (GRM) с самокритичной настройкой на основе принципов.

Согласно исследованию, новый подход превосходит существующие методы улучшения рассуждающих способностей больших языковых моделей (LLM). Тестирование показало, что модели, обученные с использованием GRM, демонстрируют максимальную производительность при обработке общих запросов, при этом требуя меньших вычислительных ресурсов.

Новые модели получили название DeepSeek-GRM, от аббревиатуры Generalist Reward Modeling (универсальное моделирование вознаграждения). Компания заявила о планах сделать модели с открытым исходным кодом, однако точные сроки релиза пока не объявлены.

Президентские выборы-2027

Происшествия

Общество

Атака на Иран

Экономика

Ситуация вокруг Украины

Общество

КОНТАКТЫ

СОЦСЕТИ

TelegramYouTubeWhatsAppFacebookInstagram

© ИА «24.kg» - Новости Кыргызстана. Все права защищены. Вся информация, размещенная на данном веб-сайте, предназначена только для персонального использования и не подлежит распространению без письменного разрешения ИА «24.kg». Редакция не несет ответственности за содержимое перепечатанных материалов и высказывания отдельных лиц. +18

Индекс цитированияЯндекс.Метрика