오픈AI가 미리 정한 선택지 가운데 하나를 고르는 결정형 API를 공개했다. 대규모 언어모델의 긴 응답 대신 구조화된 판단에 연산을 집중해 에이전트 행동 분류와 자동화 업무에 활용하는 방식이다.
오픈AI는 9월 29일 개발자 행사에서 Decisions API를 제한적 미리보기로 공개했다. 개발자는 텍스트나 이미지로 맥락을 입력한 뒤 미리 정한 답변 목록 중 하나를 받아 콘텐츠 분류, 요청 라우팅, 에이전트의 다음 행동 선택에 사용할 수 있다.
샘 알트먼(Sam Altman) 오픈AI CEO는 행사에서 Decisions API가 오픈AI의 루나 모델에 이미지 분류나 에이전트 행동처럼 미리 정한 선택지 사이의 판단을 맡기는 방식이라고 설명했다. 그는 “그 선택에 모델을 집중하면 이미지 이해, 광범위한 언어 지원, 안전장치를 유지하면서도 매우 빠르게 만들 수 있다”고 말했다.
이 API의 핵심은 범용 언어모델이 자유로운 문장을 생성하도록 두지 않고 소프트웨어가 바로 처리할 수 있는 판단값으로 출력을 제한하는 데 있다. 개발자가 선택지와 질문 유형을 미리 정하면 모델은 정해진 범위 안에서 결과를 반환한다.
이런 구조는 이메일이나 콘텐츠를 분류하거나 요청을 적절한 시스템으로 보내고, 에이전트가 다음에 할 행동을 고르는 작업에 맞는다. 모델이 매번 긴 답변을 생성하지 않기 때문에 속도와 비용을 낮출 여지가 있다.
테크크런치는 Decisions API가 타입세이프 AI가 9월 15일 공개한 제브(Jev)와 유사한 기능을 제공한다고 보도했다. 제브는 텍스트 대신 확률과 구조화된 판단을 반환하는 모델로 소개됐다.
제브는 개발자가 정한 선택지와 확률을 반환하도록 설계된 모델이다. 타입세이프 AI는 제브를 소프트웨어 자동화에 맞춘 ‘시스템 원(System One)’ 모델로 소개했으며, 텍스트 생성보다 빠른 판단과 구조화된 출력을 강조했다.
타입세이프 AI는 자체 평가에서 제브가 기존 언어모델보다 최대 193.6배 빠르고 444.6배 저렴했다고 밝혔다. 다만 이 수치는 타입세이프 AI가 설계한 평가 환경에 기반한 결과다.
디오고 알메이다(Diogo Almeida) 타입세이프 AI CEO는 오픈AI의 새 API를 두고 X에서 ‘클론 전쟁’의 시작이라고 농담했다. 그는 오픈AI의 관심이 “시스템 원과 호환되는 방식으로 구축하는 것이 미래라는 신호일 수 있다”고 말했다.
알메이다는 또 “빠르고 저렴하게 만드는 것은 매우 쉽다”며 “정말 빠르고 저렴하게 하려면 주사위를 사용하면 된다”고 말했다. 이어 중요한 것은 지능이며, 목표는 ‘달러당 지능’의 효율 곡선을 높이는 것이라고 설명했다.
결정형 모델의 활용처로는 인공지능 에이전트 감시가 거론된다. 테크크런치는 오픈AI가 인터넷에서 에이전트가 잘못된 행동을 한 사건 이후 별도 모델로 에이전트 행동을 감시하는 보안 조치를 사용하고 있으며, 상당한 컴퓨팅 비용이 든다고 전했다.
샤포르 나기브자데(Shapor Naghibzadeh) QueryStory 대표는 지난 주말 해커톤에서 제브로 에이전트의 각 행동을 과업과 대조하는 시연을 만들었다. 위험도가 높다고 판단한 행동은 차단하고, 판단이 모호한 행동은 검토 대상으로 표시하며, 나머지 행동은 허용하는 방식이다.
이 시연에서 제브를 이용한 감시 비용은 2.94달러(약 3981원)로, 프런티어 언어모델을 이용할 때의 372달러(약 50만원)보다 낮았다. 테크크런치는 특정 시연 환경에서 나온 비교이며, 오픈AI의 Decisions API가 같은 성능이나 비용을 보인다는 뜻은 아니라고 설명했다.
테크크런치는 제브를 활용한 감시가 이론상 허깅페이스에서 발생한 사건을 막을 수도 있었다고 전했다. 에이전트가 수행하는 모든 행동을 점검할 수 있을 정도로 비용이 낮다면, 작업 과정에 상시 검토 단계를 추가하는 방식으로 활용할 수 있다는 설명이다.
다만 결정형 모델의 실제 가치는 빠른 응답이나 낮은 비용만으로 결정되지 않는다. 모델이 현실의 상황에 맞게 확률을 조정하는지, 위험한 행동과 정상 행동을 얼마나 정확히 구분하는지가 함께 검증돼야 한다.
Decisions API는 현재 제한적 미리보기 단계다. 개발자들이 실제 환경에서 사용한 성능·비용·오탐률 자료가 축적되기 전까지는 제브와의 기능적 유사성 이상을 판단하기 어렵다.

서지우 기자
댓글0
첫 댓글을 남겨 보세요.