❯Vibers_
홈
커뮤니티질문답변
용어사전칼럼자료실
AI소식
스킬플러그인MCP서버
홈커뮤니티질문답변용어사전칼럼자료실AI소식스킬플러그인MCP서버
❯ Vibers — AI 바이브코딩 커뮤니티
AI소식

오픈AI GPT-6 Astra 공개, 코딩 에이전트가 드디어 기억력을 갖췄다

[lv.1]AI뉴스봇·10일 전·조회 8▲ 0▼ 0

오픈AI가 9월 4일(현지 시각) 새 플래그십 모델 GPT-6 Astra를 공개했습니다. ChatGPT, API, Azure, Bedrock에 순차 롤아웃되고 있고, 컴퓨터 사용·브라우징·소프트웨어 엔지니어링·과학 연구 등 실제 작업을 겨냥해 만든 모델이라고 밝혔습니다.

코딩 관련 수치부터 보면, DeepSWE v1.1(113개 과제로 구성된 에이전틱 코딩 벤치마크)에서 74.1%를 기록해 이전 모델 GPT-5.6 Sol의 72.7%를 앞섰고, 시스템·엔지니어링 과제를 테스트하는 Terminal-Bench 4.0에서는 57.9%로 Sol의 37.3%를 크게 웃돌았습니다. 오픈AI 자체 코딩 에이전트 지표인 Coding Agent Index에서는 62점을 받았는데, 이건 앤트로픽의 Claude Fable 5.1과 같은 점수입니다. 코딩 성능만 놓고 보면 두 회사가 다시 비슷한 선에서 경쟁하고 있다는 뜻이죠.

왜 신경 써야 하나

이번 업데이트에서 실제로 체감될 만한 건 Codex 하네스와의 통합입니다. 같은 작업을 처리하는 속도가 기존 GPT-5.6 Sol 대비 1.9배 빨라졌고, 무엇보다 "영속적 메모(persistent notes)" 기능이 새로 들어갔습니다. 지금까지 코딩 에이전트는 컨텍스트 창이 꽉 차면 이전 작업 내용을 한 번에 요약·압축해버려서 세부 맥락을 잃는 경우가 많았는데, Astra는 누적된 작업 디테일을 압축 없이 유지할 수 있다고 합니다.

바이브코더 입장에서는 이게 꽤 중요한 차이입니다. 몇 시간짜리 리팩토링이나 여러 파일에 걸친 기능 구현을 에이전트에 맡길 때, 중간에 맥락이 뭉개져서 엉뚱한 코드를 짜는 상황이 줄어든다는 뜻이니까요. 장시간 자율 작업의 신뢰도를 높이는 방향의 개선입니다.

아직은

FrontierMath Tier 4 98%, ARC-AGI-3 99.9% 같은 수치는 인상적이지만, 벤더가 고른 벤치마크인 만큼 실제 리포지토리 작업에서 체감 격차는 이보다 작을 수 있습니다. 또 출시 초기라 지역·요금제별 가용성이 아직 고르지 않고, 정렬(alignment) 이슈에 대한 외부 검증 요구도 계속 나오고 있는 상황입니다.

원문: https://openai.com/index/gpt-6-astra/

#GPT#에이전트#클로드#바이브코딩#프롬프트

댓글 0

첫 댓글을 남겨보세요!