Bảng xếp hạng model AI
So sánh GPT 6 Astra, Claude Fable 5.1, Claude Opus 5, Claude Sonnet 5 và GPT 6 Luna/Terra/Sol cùng các model hiện có trong ảnh chụp DeepSWE nội bộ của Premium Shop.
Model dẫn đầu
Claude Fable 5.1 (max)76% điểm2x
So sánh điểm DeepSWE
Độ dài thanh biểu thị điểm phần trăm. Hệ số hạn mức cho biết lượng token bị trừ tương đối và không đổi theo reasoning_effort.
- 1
Claude Fable 5.1 (max)
claude-fable-5.1
Flagship Fable 5.1 dẫn đầu benchmark với hệ số 2x.
- Mức suy luận
- max
- Hệ số hạn mức
- 2x
- Điểm
- 76%
76% - 2
GPT 6 Astra (max)
cx/gpt-6-astra
GPT 6 Astra sức mạnh đỉnh cao với hệ số 2x.
- Mức suy luận
- max
- Hệ số hạn mức
- 2x
- Điểm
- 75%
75% - 3
Claude Opus 5 (max)
claude-opus-5
Claude Opus 5: hiệu năng cao với hệ số mới 1,75x.
- Mức suy luận
- max
- Hệ số hạn mức
- 1,75x
- Điểm
- 74%
74% - 4
GPT 6 Sol (max)
cx/gpt-6-sol
Sol cho workload code khó, hệ số 1,5x.
- Mức suy luận
- max
- Hệ số hạn mức
- 1,5x
- Điểm
- 73%
73% - 5
GPT 6 Terra (max)
cx/gpt-6-terra
Terra cân bằng hiệu năng và chi phí, hệ số 1,25x.
- Mức suy luận
- max
- Hệ số hạn mức
- 1,25x
- Điểm
- 70%
70% - 6
GPT 6 Luna (max)
cx/gpt-6-luna
Luna tương đương nhóm trên nhưng chỉ tính hệ số 1x.
- Mức suy luận
- max
- Hệ số hạn mức
- 1x
- Điểm
- 67%
67% - 7
Claude Sonnet 5 (max)
claude-sonnet-5
Claude Sonnet 5: điểm khá với hệ số 1,5x.
- Mức suy luận
- max
- Hệ số hạn mức
- 1,5x
- Điểm
- 63%
63%