수개월에 걸친 개발 소문에도 불구하고 지난 주 OpenAI의 딸기 프로젝트 출시는 놀라운 일이었습니다 . 많은 분석가들은 이 모델이 가을 후반까지는 아니더라도 적어도 몇 주 동안은 준비되지 않을 것이라고 믿고 있었습니다.
새로운 o1-preview 모델과 해당 o1-mini 모델은 이미 사용 및 평가가 가능합니다. 직접 액세스하는 방법은 다음과 같습니다.
우리는 응답하기 전에 생각하는 데 더 많은 시간을 할애하도록 설계된 새로운 AI 모델 시리즈인 OpenAI o1의 미리 보기를 출시합니다.
이러한 모델은 복잡한 작업을 통해 추론하고 과학, 코딩, 수학 분야의 이전 모델보다 어려운 문제를 해결할 수 있습니다. https://t.co/peKzzKX1bu
— OpenAI(@OpenAI) 2024년 9월 12일
o1은 무엇입니까?
OpenAI는 일반 인공 지능(AGI)에 대한 열망을 숨기지 않았으며 , Project Strawberry(현재 "o1"로 알려짐)는 이러한 목표를 향한 회사의 다음 단계입니다. OpenAI 발표 게시물 에 따르면 이는 "응답하기 전에 생각하는 데 더 많은 시간을 할애하도록 설계된" 새로운 "추론" 모델 라인 중 첫 번째입니다. 이 전략을 통해 모델은 "복잡한 작업을 통해 추론하고 과학, 코딩, 수학 분야의 이전 모델보다 어려운 문제를 해결할 수 있습니다."
모델은 인간과 유사한 방식으로 추론하여 훈련을 통해 경험을 쌓으면서 "사고 과정을 개선하고, 다양한 전략을 시도하고, 실수를 인식"할 수 있다고 합니다. OpenAI에 따르면 o1-preview는 Ph.D.와 동등하게 작동합니다. 물리학, 화학, 생물학 분야의 학생들을 대상으로 하며 해당 과목의 벤치마크 테스트에서도 비슷한 결과를 보여줍니다. o1은 또한 코딩 및 수학 문제에 능숙 하며 국제 수학 올림피아드(IMO) 자격 시험에서 83%를 기록했으며, GPT-4o는 인간 상대와의 Codeforces 경쟁에서 13%에 불과하고 89번째 백분위수에 도달했습니다.
여기에 가장 유능하고 정렬된 모델 시리즈인 o1이 있습니다: https://t.co/yzZGNN8HvD
o1은 여전히 결함이 있고 제한적이며, 더 많은 시간을 보낸 후보다 처음 사용할 때 여전히 더 인상적으로 보입니다. pic.twitter.com/Qs1HoSDOz1
— 샘 알트만(@sama) 2024년 9월 12일
o1-mini는 표준 o1-preview 모델의 경량 버전입니다. 대규모 반복보다 운영 비용이 80% 저렴해 코딩 분석 및 생성 작업에 특히 적합하다고 합니다.
o1-preview를 사용해 볼 수 있나요?
예, ChatGPT Plus 및 Teams 구독자를 위해 9월 12일에 o1-preview 모델이 출시되었습니다. 기업 및 교육 사용자는 다음 주 초부터 액세스할 수 있습니다.
o1은 악의적인 행위자로부터 얼마나 안전합니까?
아주 그럴 것 같습니다. OpenAI는 모델의 향상된 추론 기능을 활용하여 안전 및 정렬 지침을 보다 효율적으로 준수할 수 있도록 완전히 새로운 안전 교육 프로그램을 개발한 것으로 알려졌습니다. 회사는 GPT-4o가 탈옥 시도에 저항하여 22점(100점 만점)을 얻은 테스트에서 새로운 o1 모델이 84점을 얻었다고 밝혔습니다.
o1-preview에 어떻게 액세스하나요?
모든 새로운 생성 AI 기능과 마찬가지로 새로 출시된 o1-preview는 현재 유료 구독자에게만 제공됩니다. 직접 사용해 보려면 월 20달러의 Plus 구독을 선택해야 합니다. 왼쪽 탐색 창 하단에 있는 업그레이드 계획 라디오 버튼을 클릭하고 화면의 지시에 따라 결제 세부 정보를 입력하기만 하면 됩니다.
구독이 활성화되면 ChatGPT 홈페이지 왼쪽에 있는 모델 선택기 토글에서 o1-preview 또는 o1-mini를 선택하세요. o1-preview의 경우 주간 메시지 30개, o1-mini의 경우 메시지 50개로 유료 사용자의 경우에도 액세스가 제한됩니다. OpenAI는 최종적으로 o1-mini를 무료 사용자에게 제공할 것이라고 밝혔지만 아직 출시 날짜는 정하지 않았습니다.