コーディング向けモデル
コード生成・リファクタ・リポジトリ理解に向くモデルを、対応機能と出力コストから整理します。
評価軸
- コード生成・リポジトリ理解の精度
- 長文コンテキスト(大規模リポジトリ読み込み)
- tool use / structured output(IDE・エージェント連携)
- 出力コスト(生成トークン量が多くなりがち)
- 失敗しやすい用途(曖昧な仕様・非標準フレームワーク)
候補モデル(verified)
| モデル | コンテキスト | tool use | reasoning |
|---|---|---|---|
| Claude Sonnet 5 | 1M | ○ | ○ |
| Grok 4.5 | 500K | ○ | ○ |
| DeepSeek V3.2 | 131K | ○ | ○ |
| Mistral Large 2512 | 262K | — | — |
| GLM 5 | 203K | ○ | ○ |