OpenAI가 GPT‑6.1 Sol을 공개함. 에이전트 코딩, 컴퓨터 사용, 전문 업무에서 GPT‑6 Astra에 근접하는 성능을 내는 GPT‑6 Sol 업그레이드로, 표준 입력/출력 토큰 가격은 Astra의 5분의 1임 DeepSWE v1.1에서 Astra와 같은 성능을 약 5분의 1 비용으로 달성했으며, 복잡한 PDF 분석과 다단계 업무 자동화 평가에서도 GPT‑6 Sol보다 성능이 향상됨 컴퓨터 사용과 과학 연구 평가에서도 작업당 비용을 줄이면서 성능을 개선함. 다만 가장 어려운 과학 연구 작업에는 평가 최고 점수를 기록한 GPT‑6 Astra 사용을 권장함 어려운 프롬프트의 사실 오류와 에이전트의 안전 제약 위반이 줄어듦. 해당 평가는 실패를 유도하는 상황을 대상으로 하므로 일반적인 사용의 실패율을 나타내지는 않음 ChatGPT Work와 Codex의 Plus, Pro, Business, Enterprise, Edu 사용자 및 API에 제공되며, Chat에서는 아직 사용할 수 없음 성능과 비용의 균형 GPT‑6.1 Sol은 코드 작성/디버깅, 문서 이해, 다단계 비즈니스 워크플로 등 복잡한 전문 업무에서 GPT‑6 Sol보다 성능이 향상됨 표준 입력/출력 토큰 가격은 GPT‑6 Astra의 5분의 1이며, 여러 평가에서 Astra에 근접하는 성능을 보임 캐시 입력 가격은 100만 토큰당 0.10달러로, 표준 입력보다 95%, GPT‑6 Sol의 캐시 입력보다 50% 저렴함 요청 간 문맥을 재사용하는 에이전트를 구축하고 운영할 비용 여유가 커짐 코딩과 전문 업무 평가 실제 코드베이스의 복잡한 소프트웨어 엔지니어링 작업을 평가하는 DeepSWE v1.1에서 GPT‑6 Astra와 같은 성능을 약 5분의 1 비용으로 달성함 GPT‑6 Sol의 최고 점수보다 6.4%포인트 높았으며, 추론 노력 수준과 비용도 더 낮았음 복잡한 PDF를 활용한 전문 질문 응답 평가인 GDP.pdf에서는 테스트한 추론 설정 전반에서 폴백을 적용한 Opus 5.5보다 높은 점수를 작업당 절반 미만의 비용으로 기록함 GPT‑6 Astra의 최고 수준 성능에도 작업당 약 5분의 1 비용으로 근접함 금융, 의료, 법률을 비롯한 10개 전문 분야의 실제 업무 PDF를 대상으로 표, 차트, 도식, 작은 글씨의 세부 정보까지 이해하는 능력을 평가함 다단계 업무 완료 여부를 평가하는 AutomationBench 1.0.6에서 중간 추론 노력 기준...
Related
AI, 데이터센터 투자 붐 정당화하려면 연 매출 6조 달러 필요
33 minutes ago
0
PS5 Relapse 익스플로잇
36 minutes ago
0
Google, ChromeOS 지원을 2년 일찍 종료
39 minutes ago
0
Tcl/Tk 9.1
42 minutes ago
0
DevDay 2026 총정리
56 minutes ago
1
1993년에 부팅한 서버, 아직 가동 중이지만 은퇴가 머지않음 (2017)
2 hours ago
0
전 세계 암 8건 중 1건은 감염이 원인이라는 연구 결과
3 hours ago
2
DraftKings, AI로 상습 도박 이용자를 행동 기반 타기팅
3 hours ago
2
Tips
click
Popular
손흥민 선제골 발판·골대 불운…LAFC, 7경기 만에 승리
2 weeks ago
54
[르포] '더 똑똑해진 전동 칫솔' 다이슨, 카메라젯 첫 공개···AI 탑재로 또 한 번 혁신
4 weeks ago
44
OpenAI 에이전트들이 RubyGems에 공개되지 않은 공격을 수행함
2 weeks ago
44
© Clint IT 2026. All rights are reserved

4 hours ago
5





English (US) ·