模型 / OpenAI

GPT-6.1 Sol

OpenAI · Proprietary

近期快照資料快照 cf-1.3
Cheese 指數67.8cf-1.3
輸入/輸出$2 / $10美元/百萬 tokens
有資料的維度5 / 13證據
上下文長度—tokens · 條件待核實

選型摘要

可優先研究 多模態、知識 相關任務;這是依目前資料觀察到的相對強項,仍需自己的任務測試。

覆蓋率是有資料的維度比例,不是可信度。部分 benchmark 條件與公開來源連結仍未提供。 缺少: 數學, 指令遵循, 多語能力, swe, terminal, gpqa, hle, mcp.

查看證據 ↓

任務能力資料

程式開發
59.0
Agent 工作流程
67.8
數學
—
知識
81.1
指令遵循
—
多模態
83.9
多語能力
—
推理
79.4
swe
—
terminal
—
gpqa
—
hle
—
mcp
—

數值為標準化維度;破折號表示未知,並非零分。

輸入/輸出

$2 / $10 · 美元/百萬 tokens

資料集所列價格,供應商條款與價格日期仍待核實。缺少免費證據的零價會視為未知。

快取、batch、工具及自建成本:尚未核實。

指數波動穩定度

100.0 · 3 天歷史

short_band

此數值反映指數波動,不代表 API 可用率或可靠率。

部署前先核實

  • 確認供應商 endpoint、授權及版本。
  • 測試自己的提示、工具呼叫與失敗恢復。
  • 用實際用量核對價格與延遲。

證據

以下為資料集公開的來源分類;沒有提供原始公開連結、樣本數與 harness 的項目仍待補足。

來源類別來源類型資料日期公開原始連結
程式開發core / official_json2026-10-03尚未公開
Agent 工作流程core / official_json2026-10-03尚未公開
depthcore / official_json2026-10-03尚未公開
已公開的計分輸入 · cf-1.3
程式開發48.7
Agent 工作流程67.8
長工作流程—
整體—

方法包含 overall,但本快照未公開此輸入,無法只靠以下軸完整重現總分。

方法說明:可用軸的中位數;有 Ops 時採用 8% 混合。以下呈現來源分數,沒有重算或補值。

計分方法 →
指數歷史
資料日期Cheese 指數
2026-10-0167.8
2026-10-0267.8
2026-10-0367.8

僅列出已記錄日期,缺日沒有補值。