1. OpenAI, GPT-5.6 빌더 가이드 공개: 에이전트 비용·성능 최적화 강조
URL: https://openai.com/index/builders-guide-to-gpt-5-6/
요약: OpenAI가 GPT-5.6을 프로덕션 에이전트에 적용하는 빌더 가이드를 공개했다. 모델 선택, reasoning effort 조정, Responses API의 retained reasoning·compaction·multi-agent orchestration·programmatic tool calling 등을 통해 장기 작업의 비용과 지연을 낮추는 패턴을 소개한다. 개발팀 입장에서는 모든 단계를 최고급 모델로 처리하기보다 Terra/Luna/Sol을 역할별로 나누고, 결정적 데이터 처리 로직은 코드로 빼는 설계가 핵심이다.
2. OpenAI, GPT-5.6 Sol Ultrafast 모드 프리뷰 공개
URL: https://openai.com/index/previewing-ultrafast/
요약: OpenAI가 Cerebras 기반 GPT-5.6 Sol Ultrafast 모드를 공개했다. 표준 처리 대비 최대 14배 빠르고 초당 최대 750개 출력 토큰을 목표로 하며, 초기에는 OpenAI API에서 일부 고객을 대상으로 제공된다. 실시간 고객지원, 음성 에이전트, 장애 대응, 금융·보안 분석처럼 지연 시간이 제품 경험을 좌우하는 영역에서 frontier model을 더 빠르게 쓰는 방향을 보여준다.
3. Google DeepMind, 코딩·에이전트용 Gemini 3.7 Flash 발표
URL: https://deepmind.google/blog/introducing-gemini-3-7-flash/
요약: Google DeepMind가 Gemini 3.7 Flash를 발표하며 가장 지능적인 workhorse 모델이라고 소개했다. 코딩, 웹 개발, 에이전트, 복잡한 문서 이해와 자동화 벤치마크에서 이전 3.6 Flash 대비 향상된 성능을 내세웠고, Gemini API·Vertex AI·Gemini Enterprise Agent Platform 등에서 사용할 수 있다. 기업용 AI 개발에서는 비용과 속도, 멀티모달 이해, 실제 워크플로 자동화 성능의 균형이 더 중요해지고 있음을 보여준다.
Sources: