Вышел OpenAI o1

Вышел OpenAI o1 ChatGPT

Вышел OpenAI o1.

Вышел OpenAI o1

 

Новая серия моделей рассуждений для решения сложных проблем. Доступно с 9.12

Мы разработали новую серию моделей ИИ, предназначенных для того, чтобы тратить больше времени на размышления, прежде чем отвечать. Они могут рассуждать о сложных задачах и решать более сложные проблемы, чем предыдущие модели в науке, кодировании и математике.

Сегодня мы выпускаем первую из этой серии в ChatGPT и нашем API. Это предварительный просмотр, и мы ожидаем регулярных обновлений и улучшений. Наряду с этим выпуском мы также включаем оценки для следующего обновления, которое в настоящее время находится в разработке.

Как это работает

Мы обучили эти модели тратить больше времени на обдумывание проблем, прежде чем они ответят, как это делает человек. Благодаря обучению они учатся совершенствовать свой мыслительный процесс, пробовать разные стратегии и распознавать свои ошибки.

В наших тестах следующее обновление модели работает так же, как аспиранты, на сложных контрольных задачах по физике, химии и биологии. Мы также обнаружили, что оно преуспевает в математике и кодировании. На отборочном экзамене Международной математической олимпиады (IMO) GPT-4o правильно решил только 13% задач, в то время как модель рассуждений набрала 83%. Их способности к кодированию оценивались на соревнованиях и достигли 89-го процентиля в соревнованиях Codeforces. Подробнее об этом можно прочитать в нашем посте по техническим исследованиям .

Как ранняя модель, она пока не имеет многих функций, которые делают ChatGPT полезным, например, просмотр веб-страниц для получения информации и загрузка файлов и изображений. Для многих распространенных случаев GPT-4o станет более способным в ближайшем будущем.

Но для сложных задач рассуждения это значительный прогресс и представляет собой новый уровень возможностей ИИ. Учитывая это, мы сбрасываем счетчик обратно на 1 и называем эту серию OpenAI o1.

Безопасность

В рамках разработки этих новых моделей мы придумали новый подход к обучению безопасности, который использует их способности к рассуждению, чтобы заставить их придерживаться правил безопасности и выравнивания. Способность рассуждать о наших правилах безопасности в контексте позволяет применять их более эффективно.

Один из способов измерения безопасности — это проверка того, насколько хорошо наша модель продолжает следовать своим правилам безопасности, если пользователь пытается обойти их (это называется «джейлбрейк»). В одном из наших самых сложных тестов на джейлбрейк GPT-4o набрал 22 (по шкале от 0 до 100), а наша модель o1-preview набрала 84. Подробнее об этом можно прочитать в системной карточке и в нашем исследовательском посте .

Чтобы соответствовать новым возможностям этих моделей, мы усилили нашу работу по безопасности, внутреннее управление и сотрудничество с федеральным правительством. Это включает в себя тщательное тестирование и оценку с использованием нашей Рамочной основы готовности(открывается в новом окне), лучшая в своем классе команда экспертов и процессы обзора на уровне совета директоров, в том числе нашим Комитетом по безопасности и защите.

Для продвижения нашей приверженности безопасности ИИ мы недавно оформили соглашения с Институтами безопасности ИИ США и Великобритании. Мы начали реализовывать эти соглашения, включая предоставление институтам раннего доступа к исследовательской версии этой модели. Это был важный первый шаг в нашем партнерстве, помогающий наладить процесс исследования, оценки и тестирования будущих моделей до и после их публичного выпуска.

Для кого это?

Эти расширенные возможности рассуждения могут быть особенно полезны, если вы решаете сложные проблемы в науке, кодировании, математике и подобных областях. Например, o1 может использоваться исследователями в области здравоохранения для аннотирования данных секвенирования клеток, физиками для генерации сложных математических формул, необходимых для квантовой оптики, и разработчиками во всех областях для создания и выполнения многоэтапных рабочих процессов.

OpenAI o1-мини

Серия o1 отлично подходит для точной генерации и отладки сложного кода. Чтобы предложить разработчикам более эффективное решение, мы также выпускаем OpenAI o1-mini — более быструю и дешевую модель рассуждений, которая особенно эффективна при кодировании. Как более мелкая модель, o1-mini на 80% дешевле o1-preview, что делает ее мощной и экономически эффективной моделью для приложений, требующих рассуждений, но не широких знаний о мире.

Как использовать OpenAI o1

Пользователи ChatGPT Plus и Team смогут получить доступ к моделям o1 в ChatGPT с сегодняшнего дня. Как o1-preview, так и o1-mini можно будет выбрать вручную в средстве выбора моделей, а на момент запуска недельные лимиты будут составлять 30 сообщений для o1-preview и 50 для o1-mini. Мы работаем над повышением этих тарифов и позволим ChatGPT автоматически выбирать правильную модель для заданного запроса.

Изображение нового раскрывающегося списка ChatGPT, отображающего новую модель «o1-preview» на ярком желто-синем абстрактном фоне

Пользователи ChatGPT Enterprise и Edu получат доступ к обеим моделям со следующей недели.

Разработчики , которые соответствуют требованиям API-уровня использования 5 (открывается в новом окне)можно начать прототипирование с обеими моделями в API сегодня с ограничением скорости 20 RPM. Мы работаем над увеличением этих ограничений после дополнительного тестирования. API для этих моделей в настоящее время не включает вызов функций, потоковую передачу, поддержку системных сообщений и другие функции. Чтобы начать, ознакомьтесь с документацией API(открывается в новом окне).

Мы также планируем предоставить доступ к o1-mini всем пользователям ChatGPT Free . 

Что дальше?

Это ранний предварительный просмотр этих моделей рассуждений в ChatGPT и API. В дополнение к обновлениям моделей мы ожидаем добавить просмотр, загрузку файлов и изображений и другие функции, чтобы сделать их более полезными для всех.

Мы также планируем продолжить разработку и выпуск моделей в нашей серии GPT, в дополнение к новой серии OpenAI o1.

Искусственный интеллект, нейросети, ии в Минске
Добавить комментарий