TechBrief Index는 AI 모델과 도구의 성능·가격·사양을 같은 기준으로 정리해 계속 갱신하는 표입니다. 기사마다 다른 기준을 쓰면 비교가 성립하지 않기 때문에, 수치는 한 곳에서만 관리하고 모든 글이 이 데이터를 참조합니다.
Index 목록
- AI Coding Index
Claude Code·Codex·Cursor·Copilot·Gemini CLI의 요금제와 사용량 한도를 공식 문서 기준으로 비교합니다. - AI Model Index
주요 LLM의 성능·API 가격·컨텍스트 길이를 동일 조건으로 비교합니다. - AI Benchmark Index
AA Intelligence Index·ARC-AGI·LMArena·SWE-bench 등이 무엇을 측정하고 무엇을 측정하지 못하는지 해설합니다.
데이터 출처 우선순위
같은 항목에 대해 값이 엇갈리면 아래 순서에서 위쪽 출처를 채택합니다. 등급이 같으면 확인일이 최신인 값을 씁니다.
- ① 공식 발표
- ② 공식 API 문서
- ③ Artificial Analysis
- ④ ARC Prize
- ⑤ LMArena
- ⑥ 기타 독립 벤치마크
- ⑦ TechBrief 자체 테스트
- ⑧ 참고 기사
참고 기사(⑧)는 사실 확인의 단서로만 쓰고 수치의 근거로는 사용하지 않습니다. 제조사가 자사 모델을 측정해 발표한 수치는 그 사실을 함께 표기하며, 교차 모델 비교에는 쓰지 않습니다.
표기 원칙
- 모든 표에 최종 업데이트 날짜를 표시합니다.
- 실행 조건(effort·routing)이 다른 값은 같은 축에서 비교하지 않으며, 불가피하게 섞일 때는 그 사실을 캡션에 밝힙니다.
- 확인하지 못한 값은 추정하거나 0으로 채우지 않고 ‘미공개’로 표기합니다.
- 동일 조건으로 확인되지 않은 모델은 제외하고, 제외 사유를 함께 공개합니다.
- 그래프에서 축 범위를 조정한 경우 그 사실을 캡션에 표시합니다.
수치 오류나 누락을 발견하면 문의로 알려주세요. 확인 후 데이터셋을 수정하고 갱신일을 갱신합니다.
