Все новости
Это интересно
Сейчас читают
Технологии
Аватар Evernews Evernews

Рассуждающую модель уровня OpenAI o1 сделали за $50

0
0
Поделиться
Телеграфировать

До обучения с нуля дело все-таки не дошло.

Рассуждающую модель уровня OpenAI o1 сделали за $50

Стартап OpenAI сейчас развивает семейство рассуждающих моделей o: две версии o1 уже выпущены, доступна o3-mini (o2 решили пропустить), на подходе полноценная версия o3. Исследователи из Стэнфорда и Вашингтонского университета решили выяснить, можно ли сделать подобную модель на базе открытых аналогов.

Оказалось — можно. В качестве подтверждения ученые выложили модель, получившую название s1: это рассуждающая модель с открытыми исходниками, по качеству ответов на математические вопросы сопоставимая с OpenAI o1-preview и DeepSeek R1.

Примечательно, что создание s1 обошлось энтузиастам примерно в $50. Об обучении модели с нуля речь не шла: исследователи взяли модель Gemini 2.0 Flash Thinking Experimental от Google, доступ к которой предоставляется бесплатно.

Модель s1 обучалась за счет дистилляции, то есть нейросеть учили на базе ответов Gemini 2.0 Flash Thinking Experimental. Предполагается, что похожим образом могла быть обучена модель R1 от DeepSeek, только в роли исходника были модели OpenAI.

Для обучения s1 использовали всего 1000 «тщательно отобранных» вопросов с ответами на них, сгенерированными моделью Google. Вместе с самими ответами модели исследователей скармливали и всю цепочку рассуждений.

Интересный момент: хотя OpenAI и ее конкуренты используют для создания рассуждающих моделей обучение с подкреплением, авторы s1 обошлись без него. Вместо этого ученые просто попросили модель имитировать определенное поведение и «подождать» — это почему-то повысило качество ответов.

Читать далее
Сколько вы тратите на игры за год?
Больше 100000 рублей
393 голоса, 5.8%
От 50000 до 100000 рублей
250 голосов, 3.7%
От 25000 до 50000 рублей
291 голос, 4.3%
От 10000 до 25000 рублей
563 голоса, 8.3%
До 10000 рублей
1330 голосов, 19.5%
Нисколько, я пират. Йо-хо-хо!
3986 голосов, 58.5%
Теги: Технологии
Аватар Evernews
Evernews
8074 подписчика