DeepSWE · Ảnh chụp tĩnh

Bảng xếp hạng model AI

So sánh Claude Opus 5, Claude Sonnet 5 và GPT 5.6 Luna/Terra/Sol ở mức xHigh và max cùng các model hiện có trong ảnh chụp DeepSWE nội bộ của Premium Shop.

Model dẫn đầu

Claude Opus 5 (max)74% điểm2,5x

Điểm benchmark

So sánh điểm DeepSWE

Độ dài thanh biểu thị điểm phần trăm. Hệ số hạn mức cho biết lượng token bị trừ tương đối cho cấu hình đó.

Điểm cao hơn xếp trước
  1. 1

    Claude Opus 5 (max)

    claude-opus-5

    Điểm DeepSWE cao nhất trong ảnh chụp này.

    Mức suy luận
    max
    Hệ số hạn mức
    2,5x
    Điểm
    74%
    74%
  2. 2

    GPT 5.6 Sol (max)

    cx/gpt-5.6-sol

    Sol max sát nhóm dẫn đầu cho workload code khó.

    Mức suy luận
    max
    Hệ số hạn mức
    2,5x
    Điểm
    73%
    73%
  3. 3

    GPT 5.6 Sol (xHigh)

    cx/gpt-5.6-sol

    Sol non-max cho workload code khó.

    Mức suy luận
    xhigh
    Hệ số hạn mức
    2x
    Điểm
    71%
    71%
  4. 4

    GPT 5.6 Terra (max)

    cx/gpt-5.6-terra

    Terra max cân bằng hiệu năng và chi phí.

    Mức suy luận
    max
    Hệ số hạn mức
    2x
    Điểm
    70%
    70%
  5. 5

    GPT 5.6 Luna (max)

    cx/gpt-5.6-luna

    Luna max ngang nhóm dẫn đầu với hệ số 2x.

    Mức suy luận
    max
    Hệ số hạn mức
    2x
    Điểm
    67%
    67%
  6. 6

    GPT 5.5 (xHigh)

    cx/gpt-5.5-xhigh

    Model GPT 5.5 xHigh ổn định.

    Mức suy luận
    xhigh
    Hệ số hạn mức
    2x
    Điểm
    67%
    67%
  7. 7

    Claude Sonnet 5 (max)

    claude-sonnet-5

    Claude Sonnet 5 max: điểm khá với hệ số thấp nhất trong nhóm max.

    Mức suy luận
    max
    Hệ số hạn mức
    1,5x
    Điểm
    63%
    63%
  8. 8

    GPT 5.6 Terra (xHigh)

    cx/gpt-5.6-terra

    Terra non-max cho bài toán trung và cao.

    Mức suy luận
    xhigh
    Hệ số hạn mức
    1,5x
    Điểm
    60%
    60%
  9. 9

    GPT 5.6 Luna (xHigh)

    cx/gpt-5.6-luna

    Luna xHigh tiết kiệm nhất trong bộ GPT 5.6.

    Mức suy luận
    xhigh
    Hệ số hạn mức
    1x
    Điểm
    57%
    57%