GPT-6 Astra 공개: 벤치마크·가격·사이버 등급 완전 정리
OpenAI가 GPT-6 Astra를 공개했습니다. ARC-AGI-3 99.9%, 수학 97.6%, 그리고 첫 ‘Critical’ 사이버 등급까지 — 공식 수치로 정리합니다.
혁신적인 아이디어와 최신 기술이 만나는 곳, 코드로 세상을 바꾸는 창의적 여정입니다.
OpenAI가 GPT-6 Astra를 공개했습니다. ARC-AGI-3 99.9%, 수학 97.6%, 그리고 첫 ‘Critical’ 사이버 등급까지 — 공식 수치로 정리합니다.
Apptics 편집장 서상덕이 공식 Gemini API 문서와 Google DeepMind 모델 카드를 바탕으로 정리한 기술 분석 글입니다. 코딩 벤치마크에서 Claude Opus 5와 거의 같은 점수를 내는데, 가격은 입력 토큰 기준 7분의 …
Anthropic 공식 발표문·개발자 문서·Artificial Analysis 리더보드·주요 외신 보도를 직접 확인하고 정리한 실무 중심 가이드입니다. 어제(9월 1일), Anthropic이 Claude Fable 5.1과 Claude Mythos 5.1을 동시에 공개했습니다. 발표 하루 만에 독립 벤치마크 …
글 쓴 사람 서상덕 (Apptics 에디터) — 이 글은 Z.ai 공식 문서·블로그, OpenRouter·Artificial Analysis 공개 데이터를 직접 확인하고 정리한 모델 분석 기사입니다. 별도 실사용 테스트는 포함되지 않았습니다. 무료로 풀린 정체불명 …
이 글은 AI 코딩 도구 생태계를 추적해 온 Apptics 편집부가 작성했습니다. 메타 공식 발표(Zuckerberg·Alexandr Wang·Shengjia Zhao)와 커뮤니티 독립 벤치마크 데이터를 교차 확인해 정리했으며, 메타 공식 블로그 페이지는 자바스크립트 렌더링 구조라 …
이 글은 AI 모델 생태계를 추적·분석해 온 Apptics 편집부가 작성했습니다. OpenRouter 공식 모델 페이지와 커뮤니티 검증 데이터를 직접 확인하고, 현재까지 알려진 OX Alpha 관련 정보를 정리했습니다. 8월 20일, 아무런 발표 …
AI가 답은 잘 쓰는데, 일은 안 해준다 AI 챗봇에게 “이거 처리해줘”라고 말해본 적 있으시죠? 결과는 항상 같습니다. 멋진 답변은 나오는데, 실제 업무는 여전히 내 손에서 끝납니다. CRM 입력도, 청구서 처리도, …
베이스 모델은 그대로인데 코딩 점수가 50% 올랐습니다 2026년 8월 14일, 지푸 AI(Z.ai)가 GLM-5.3을 공개했습니다. 이번 발표에서 가장 눈에 띄는 건 성능 숫자가 아니라 접근법입니다. GLM-5.3은 GLM-5.2와 완전히 같은 베이스 모델을 …
그로크 4.5 나온 지 한 달도 안 돼서 또 나왔습니다 2026년 8월 12일, xAI(현 SpaceXAI)가 Grok 4.6을 출시했습니다. Grok 4.5가 7월 16일에 나왔으니 딱 27일 만입니다. 그런데 이번 발표에서 눈에 …
AI 코딩 에이전트를 3개, 5개씩 동시에 돌리는 개발자가 늘고 있습니다. 한 터미널에서는 리팩터링을, 다른 터미널에서는 테스트 작성과 버그 수정이 동시에 돌아가는 식이죠. 그런데 정작 힘든 건 코드가 아니라 관리입니다. 어느 …