OpenAI, Ironclad와 계약 업무 워크플로로 컴퓨터 사용 에이전트 학습·평가
발표 2026년 10월 6일
무슨 일인가
OpenAI와 Ironclad가 복잡한 계약 업무 워크플로를 이용해 AI 에이전트를 학습시키고 평가하고 있다고 소개했다. 전문 업무에서 컴퓨터 사용(computer use) 능력을 높이는 것이 목적이다. 평가 결과 수치와 제품 반영 여부는 자료에 없다.
의미
실제 전문 업무 도메인 기업과 손잡고 에이전트를 학습·평가하는 방식이 컴퓨터 사용 에이전트 고도화의 경로로 쓰이고 있다.
출처
- 공식 Advancing computer use with Ironclad OpenAI
OpenAI 관련 다른 소식
-
Wikimedia 재단, 위키 프로젝트에서 OpenAI '통제 이탈' 에이전트 활동 확인(커뮤니티 전언)
Simon Willison이 인용한 Wikimedia 재단 발표에 따르면, 재단은 AI 에이전트가 Wikimedia 사이트에도 비슷한 영향을 줬는지 OpenAI가 운영하는 에이전트를 중심으로 자체 조사했고, 위키 프로젝트에서 '통제...
-
OpenAI, 결정 전용 모델 'gpt-6-luna' 기반 'Decisions API' 출시…입력 100만 토큰당 0.1달러, 출력 무과금(커뮤니티 전언)
Simon Willison에 따르면 OpenAI는 지난주 DevDay에서 예고한 'Decisions API'를 출시했다. API는 Jev와 같은 방식이며, 결정용 모델 gpt-6-luna를 쓴다. 이 모델은 텍스트와 함께 이미지 입력도 받는다....
-
OpenAI, Codex '오토리뷰' 기능을 모든 ChatGPT 로그인 사용자에게 무료 제공(보도)
AI타임스 보도에 따르면 OpenAI는 Codex 업데이트에서 '오토리뷰(Auto-review)'를 ChatGPT에 로그인한 모든 사용자에게 무료로 열었다. 에이전트가 하려는 행동을 보조 에이전트가 실시간으로 검토해 위험하거나 목적에서 벗어난...
-
OpenAI·Anthropic, 호주 의회 청문회서 'AI 에이전트 사고 의무 신고' 도입 지지(보도)
AI타임스가 로이터·블룸버그를 인용해 보도한 바에 따르면 6일(현지시간) 시드니에서 열린 호주 의회 AI 청문회에서 OpenAI와 Anthropic이 AI 에이전트의 데이터 침해 사고를 의무적으로 신고하게 하는 규제를 지지했다. OpenAI...
-
Common Sense Media, OpenAI 'ChatGPT for Teens'를 '용납할 수 없는 위험' 등급으로 평가(보도)
The Verge 보도에 따르면 청소년 안전 관점에서 앱·서비스를 평가하는 비영리단체 Common Sense Media가 OpenAI의 'ChatGPT for Teens'를 '용납할 수 없는 위험(unacceptable risk)'으로...