DeepSWE · Ảnh chụp tĩnh

Bảng xếp hạng model AI

So sánh GPT 6 Astra, Claude Fable 5.1, Claude Opus 5, Claude Sonnet 5 và GPT 6 Luna/Terra/Sol cùng các model hiện có trong ảnh chụp DeepSWE nội bộ của Premium Shop.

Model dẫn đầu

Claude Fable 5.1 (max)76% điểm2x

Điểm benchmark

So sánh điểm DeepSWE

Độ dài thanh biểu thị điểm phần trăm. Hệ số hạn mức cho biết lượng token bị trừ tương đối và không đổi theo reasoning_effort.

Điểm cao hơn xếp trước
  1. 1

    Claude Fable 5.1 (max)

    claude-fable-5.1

    Flagship Fable 5.1 dẫn đầu benchmark với hệ số 2x.

    Mức suy luận
    max
    Hệ số hạn mức
    2x
    Điểm
    76%
    76%
  2. 2

    GPT 6 Astra (max)

    cx/gpt-6-astra

    GPT 6 Astra sức mạnh đỉnh cao với hệ số 2x.

    Mức suy luận
    max
    Hệ số hạn mức
    2x
    Điểm
    75%
    75%
  3. 3

    Claude Opus 5 (max)

    claude-opus-5

    Claude Opus 5: hiệu năng cao với hệ số mới 1,75x.

    Mức suy luận
    max
    Hệ số hạn mức
    1,75x
    Điểm
    74%
    74%
  4. 4

    GPT 6 Sol (max)

    cx/gpt-6-sol

    Sol cho workload code khó, hệ số 1,5x.

    Mức suy luận
    max
    Hệ số hạn mức
    1,5x
    Điểm
    73%
    73%
  5. 5

    GPT 6 Terra (max)

    cx/gpt-6-terra

    Terra cân bằng hiệu năng và chi phí, hệ số 1,25x.

    Mức suy luận
    max
    Hệ số hạn mức
    1,25x
    Điểm
    70%
    70%
  6. 6

    GPT 6 Luna (max)

    cx/gpt-6-luna

    Luna tương đương nhóm trên nhưng chỉ tính hệ số 1x.

    Mức suy luận
    max
    Hệ số hạn mức
    1x
    Điểm
    67%
    67%
  7. 7

    Claude Sonnet 5 (max)

    claude-sonnet-5

    Claude Sonnet 5: điểm khá với hệ số 1,5x.

    Mức suy luận
    max
    Hệ số hạn mức
    1,5x
    Điểm
    63%
    63%