[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"article-claude-sonnet-5-pricing-benchmarks-openrouter-zh":3,"article-related-claude-sonnet-5-pricing-benchmarks-openrouter-zh":32,"series-model-release-f0cba6ba-77cb-425b-a60d-40e8c928ed2b":79},{"id":4,"slug":5,"title":6,"content":7,"summary":8,"source":9,"source_url":10,"author":11,"image_url":12,"cover_image":12,"category":13,"language":14,"translated_content":11,"related_article_id":15,"keywords":16,"key_takeaways":25,"views":29,"created_at":30,"published_at":31,"topic_cluster_id":11},"f0cba6ba-77cb-425b-a60d-40e8c928ed2b","claude-sonnet-5-pricing-benchmarks-openrouter-zh","Claude Sonnet 5 在 OpenRouter 的定價與基準","\u003Cp data-speakable=\"summary\">OpenRouter 顯示 \u003Ca href=\"\u002Ftag\u002Fclaude\">Claude\u003C\u002Fa> Sonnet 5 的輸入價格是每百萬 token 2 \u003Ca href=\"\u002Fnews\u002Fcognition-40b-valuation-funding-talks-zh\">美元\u003C\u002Fa>，輸出是 10 美元。\u003C\u002Fp>\u003Cp>\u003Ca href=\"https:\u002F\u002Fopenrouter.ai\u002Fanthropic\u002Fclaude-sonnet-5\" target=\"_blank\" rel=\"noopener\">Claude Sonnet 5\u003C\u002Fa> 在 OpenRouter 上的資訊很完整。它有 1M token context、adaptive thinking，還把供應商延遲、吞吐量、uptime 一起列出來。這種頁面很實用，因為你不用只看模型名單，還能直接看部署成本。\u003C\u002Fp>\u003Ctable>\u003Cthead>\u003Ctr>\u003Cth>指標\u003C\u002Fth>\u003Cth>數值\u003C\u002Fth>\u003Cth>意義\u003C\u002Fth>\u003C\u002Ftr>\u003C\u002Fthead>\u003Ctbody>\u003Ctr>\u003Ctd>輸入價格\u003C\u002Ftd>\u003Ctd>$2 \u002F 1M tokens\u003C\u002Ftd>\u003Ctd>影響 prompt 與檢索內容成本\u003C\u002Ftd>\u003C\u002Ftr>\u003Ctr>\u003Ctd>輸出價格\u003C\u002Ftd>\u003Ctd>$10 \u002F 1M tokens\u003C\u002Ftd>\u003Ctd>影響長回答與 agent 迴圈成本\u003C\u002Ftd>\u003C\u002Ftr>\u003Ctr>\u003Ctd>Context window\u003C\u002Ftd>\u003Ctd>1M tokens\u003C\u002Ftd>\u003Ctd>適合長文件與大型程式碼庫\u003C\u002Ftd>\u003C\u002Ftr>\u003Ctr>\u003Ctd>發布日期\u003C\u002Ftd>\u003Ctd>2026-06-30\u003C\u002Ftd>\u003Ctd>代表 Sonnet 系列較新的版本\u003C\u002Ftd>\u003C\u002Ftr>\u003Ctr>\u003Ctd>最佳延遲\u003C\u002Ftd>\u003Ctd>1.22 秒\u003C\u002Ftd>\u003Ctd>OpenRouter 供應商表中的 Azure 數據\u003C\u002Ftd>\u003C\u002Ftr>\u003Ctr>\u003Ctd>最佳吞吐量\u003C\u002Ftd>\u003Ctd>70 tok\u002Fs\u003C\u002Ftd>\u003Ctd>適合聊天與 agent 工作流\u003C\u002Ftd>\u003C\u002Ftr>\u003C\u002Ftbody>\u003C\u002Ftable>\u003Ch2>這個模型頁面在講什麼\u003C\u002Fh2>\u003Cp>OpenRouter 把 Sonnet 5 放在「可直接拿去上線」的位置。它不是只秀規格，而是把價格、供應商、路由模式和 \u003Ca href=\"\u002Ftag\u002Fbenchmark\">benchmark\u003C\u002Fa> 放在同一頁。對工程團隊來說，這比一張單純的模型卡更有用。\u003C\u002Fp>\n\u003Cfigure class=\"my-6\">\u003Cimg src=\"https:\u002F\u002Fxxdpdyhzhpamafnrdkyq.supabase.co\u002Fstorage\u002Fv1\u002Fobject\u002Fpublic\u002Fcovers\u002Finline-1787038373012-jtov.png\" alt=\"Claude Sonnet 5 在 OpenRouter 的定價與基準\" class=\"rounded-xl w-full\" loading=\"lazy\" \u002F>\u003C\u002Ffigure>\n\u003Cp>這個模型主打 coding、agents 和專業工作。它支援 text、image、file 三種輸入，也有 low、medium、high、max、x-high 等 thinking levels。這代表它比較像一個能處理混合任務的工作馬，不是只能聊天的 demo 模型。\u003C\u002Fp>\u003Cp>如果你在做產品，這些資訊會直接影響架構。長 context 可以少切段，文件分析可以少做重組，\u003Ca href=\"\u002Ftag\u002Fagent\">agent\u003C\u002Fa> 也能少來回呼叫。對開發者來說，省下來的是時間，不只是 token。\u003C\u002Fp>\u003Cul>\u003Cli>1M token context，適合長文件與大型 repo\u003C\u002Fli>\u003Cli>adaptive thinking levels，方便控制推理成本\u003C\u002Fli>\u003Cli>支援 text、image、file\u003C\u002Fli>\u003Cli>有 real-time cyber safeguards\u003C\u002Fli>\u003C\u002Ful>\u003Cp>最後一點常被忽略。OpenRouter 提到它有即時 cyber safeguards，會擋掉\u003Ca href=\"\u002Fnews\u002Fclaude-watermark-users-cancel-subscriptions-zh\">部分\u003C\u002Fa>高風險雙重用途請求。對要做工具型產品的人，這會影響 prompt 設計，也會影響你的權限切分。\u003C\u002Fp>\u003Ch2>價格看起來簡單，實際帳單沒那麼單純\u003C\u002Fh2>\u003Cp>OpenRouter 的標價很直接。輸入是每百萬 token 2 美元，輸出是每百萬 token 10 美元。這組價格對長輸出特別敏感，因為很多 agent 工作流不是吃 prompt，而是吃回覆長度。\u003C\u002Fp>\u003Cp>真正麻煩的是供應商差異。OpenRouter 同一個模型下，會列出不同 provider 的速度、uptime 和成本。你看到的不是單一 API，而是多個後端一起競爭。\u003C\u002Fp>\u003Cp>這也解釋了為什麼 routing 很重要。某些情況下，平均實付成本會比標價低，因為有 caching 和折扣。對產品團隊來說，這種彈性比漂亮的宣傳詞更值錢。\u003C\u002Fp>\u003Cblockquote>“OpenRouter is introducing a new pricing and routing model called the OpenRouter API.” — OpenRouter blog, 2024\u003C\u002Fblockquote>\u003Cp>這句話講得很直白。你買的不是一個固定端點，而是一層可切換的模型路由。當某個 provider 慢了，或短暫出問題，系統可以改走別條路。\u003C\u002Fp>\u003Cp>OpenRouter 也提供 Balanced、Nitro、Exacto 等路由模式。你想省錢、想快一點，或想提高 tool-calling 精準度，都可以\u003Ca href=\"\u002Fnews\u002Fqvirl-bayesian-irl-uncertainty-zh\">用不\u003C\u002Fa>同策略去調整。這種設計很像把模型選擇權交回給工程師。\u003C\u002Fp>\u003Ch2>benchmark 和供應商數據更有參考價值\u003C\u002Fh2>\u003Cp>OpenRouter 的 benchmark 區塊給了 Sonnet 5 不錯的成績。它在 GPQA Diamond、TAU-Bench 這類標準測試上都有表現，而且不同 provider 的差距沒有大到離譜。這表示模型能力穩，真正差別多半在部署條件。\u003C\u002Fp>\n\u003Cfigure class=\"my-6\">\u003Cimg src=\"https:\u002F\u002Fxxdpdyhzhpamafnrdkyq.supabase.co\u002Fstorage\u002Fv1\u002Fobject\u002Fpublic\u002Fcovers\u002Finline-1787038394677-qeob.png\" alt=\"Claude Sonnet 5 在 OpenRouter 的定價與基準\" class=\"rounded-xl w-full\" loading=\"lazy\" \u002F>\u003C\u002Ffigure>\n\u003Cp>延遲和吞吐量更能反映真實體感。Azure 在 OpenRouter 表上顯示 1.22 秒延遲、70 tok\u002Fs 吞吐量。\u003Ca href=\"\u002Ftag\u002Fanthropic\">Anthropic\u003C\u002Fa> 自家端點是 1.68 秒和 56 tok\u002Fs。這種差距在聊天產品裡很明顯。\u003C\u002Fp>\u003Cp>如果你的產品是客服、編輯器、agent 或工作流自動化，延遲就是體感。差 0.5 秒，使用者可能就覺得「卡」。差 10 tok\u002Fs，長回答的等待時間也會拉開。\u003C\u002Fp>\u003Cul>\u003Cli>Azure：1.22 秒，70 tok\u002Fs，99.96% uptime\u003C\u002Fli>\u003Cli>Anthropic：1.68 秒，56 tok\u002Fs，99.99% uptime\u003C\u002Fli>\u003Cli>Claude Platform on AWS：2.76 秒，48 tok\u002Fs，99.96% uptime\u003C\u002Fli>\u003Cli>Google Vertex Global：2.98 秒，60 tok\u002Fs，99.89% uptime\u003C\u002Fli>\u003Cli>OpenRouter 24 小時可用率：99.66%\u003C\u002Fli>\u003Cli>未經路由的可用率：92.70%\u003C\u002Fli>\u003C\u002Ful>\u003Cp>這組數字最值得看的是可用率差距。OpenRouter 顯示 24 小時整體可用率是 99.66%，但沒有路由時只有 92.70%。對線上產品來說，這不是小修小補，而是會直接影響 SLA 的差異。\u003C\u002Fp>\u003Cp>三天數據也有意思。OpenRouter 顯示三天 uptime 為 100.00%，三天可用率為 99.80%。這種資料對 agent 或支援系統很重要，因為它們不能常常等模型恢復。\u003C\u002Fp>\u003Ch2>流量數據透露真實用途\u003C\u002Fh2>\u003Cp>OpenRouter 的公開 app 排名，比單看 benchmark 更接近真實世界。Claude Sonnet 5 出現在 \u003Ca href=\"https:\u002F\u002Fwww.anthropic.com\u002Fclaude-code\" target=\"_blank\" rel=\"noopener\">Claude Code\u003C\u002Fa>、\u003Ca href=\"https:\u002F\u002Fnousresearch.com\u002Fhermes\" target=\"_blank\" rel=\"noopener\">Hermes Agent\u003C\u002Fa>、\u003Ca href=\"https:\u002F\u002Fwww.descript.com\" target=\"_blank\" rel=\"noopener\">Descript\u003C\u002Fa>、\u003Ca href=\"https:\u002F\u002Fwww.openclaw.ai\" target=\"_blank\" rel=\"noopener\">OpenClaw\u003C\u002Fa>、\u003Ca href=\"https:\u002F\u002Fwww.framer.com\" target=\"_blank\" rel=\"noopener\">Framer\u003C\u002Fa> 這些產品裡。這些產品差很多，代表它的用途也很廣。\u003C\u002Fp>\u003Cp>OpenRouter 顯示 \u003Ca href=\"\u002Ftag\u002Fclaude-code\">Claude Code\u003C\u002Fa> 有 624B tokens，Hermes Agent 有 528B，Descript 有 466B。這組量級很大，代表 Sonnet 5 已經進到 agent-heavy 和 production-heavy 場景，不只是拿來做聊天。\u003C\u002Fp>\u003Cp>對工程主管來說，這比廣告文案可靠。模型在大流量產品裡出現，通常表示它能撐住複雜工作流。當然，這不代表每個團隊都該直接跟進，但至少能知道市場怎麼用它。\u003C\u002Fp>\u003Cp>如果你想把它跟其他供應商比，\u003Ca href=\"https:\u002F\u002Fwww.anthropic.com\" target=\"_blank\" rel=\"noopener\">Anthropic\u003C\u002Fa>、\u003Ca href=\"https:\u002F\u002Fcloud.google.com\u002Fvertex-ai\" target=\"_blank\" rel=\"noopener\">Google Vertex AI\u003C\u002Fa>、\u003Ca href=\"https:\u002F\u002Fazure.microsoft.com\u002Fen-us\u002Fproducts\u002Fai-services\u002Fopenai-service\" target=\"_blank\" rel=\"noopener\">Azure\u003C\u002Fa>、\u003Ca href=\"https:\u002F\u002Faws.amazon.com\u002Fbedrock\u002F\" target=\"_blank\" rel=\"noopener\">Amazon Bedrock\u003C\u002Fa> 都能提供類似模型接入，但成本和延遲會不同。OpenRouter 的價值，就是把這些差異攤開來看。\u003C\u002Fp>\u003Ch2>台灣團隊可以怎麼看這組數字\u003C\u002Fh2>\u003Cp>如果你在台灣做 SaaS、客服系統、內部知識庫，Sonnet 5 的 1M context 很有吸引力。大型文件、法務條款、程式碼審查，這些場景都很吃上下文長度。你不用一直拆段，也不用一直重送資料。\u003C\u002Fp>\u003Cp>但輸出價格是 10 美元每百萬 token，這點不能忽略。只要你的產品會產生長回覆，成本就會快速累積。很多團隊一開始只算 prompt，最後帳單爆掉，問題都出在 output。\u003C\u002Fp>\u003Cp>我會把它看成一個偏高品質、偏高控制度的選項。先用 routing 測 latency，再看實際 token 消耗，最後才決定要不要把它放進預設路徑。這樣比較務實，也比較不會被 demo 帶著走。\u003C\u002Fp>\u003Ch2>我會怎麼下結論\u003C\u002Fh2>\u003Cp>Claude Sonnet 5 在 OpenRouter 上的訊號很清楚。價格不算低，但 1M context、供應商比較、路由彈性和 benchmark 都很完整。它適合要做正式產品的團隊，不太適合只想試玩的人。\u003C\u002Fp>\u003Cp>如果你正在選模型，我會先問一個問題：你的工作流是吃輸入，還是吃輸出。答案會直接決定這個模型值不值得上線。對很多 agent 產品來說，這個問題比「模型有多強」更重要。\u003C\u002Fp>\u003Cp>接下來最實際的做法，是拿你的真實 prompt 跑一次 OpenRouter。看延遲，看輸出長度，看不同 provider 的穩定度。數字會比宣傳頁面誠實很多。\u003C\u002Fp>","OpenRouter 顯示 Claude Sonnet 5 的輸入價格為每百萬 token 2 美元、輸出 10 美元，並提供 1M context、供應商延遲與 benchmark 數據。","openrouter.ai","https:\u002F\u002Fopenrouter.ai\u002Fanthropic\u002Fclaude-sonnet-5",null,"https:\u002F\u002Fxxdpdyhzhpamafnrdkyq.supabase.co\u002Fstorage\u002Fv1\u002Fobject\u002Fpublic\u002Fcovers\u002Finline-1787038373012-jtov.png","model-release","zh","08360412-a7dd-47d8-8318-0e2f12a39a4e",[17,18,19,20,21,22,23,24],"Claude Sonnet 5","OpenRouter","Anthropic","LLM pricing","token pricing","benchmark","context window","AI routing",[26,27,28],"OpenRouter 顯示 Claude Sonnet 5 的價格為輸入 $2、輸出 $10 每百萬 token。","它有 1M token context，適合長文件、程式碼庫和 agent 工作流。","OpenRouter 的供應商與 routing 數據，對實際延遲和可用率比單看 benchmark 更有參考價值。",0,"2026-08-18T07:32:30.9318+00:00","2026-08-18T07:32:30.925+00:00",{"tags":33,"relatedLang":38,"relatedPosts":42},[34,36],{"name":18,"slug":35},"openrouter",{"name":19,"slug":37},"anthropic",{"id":15,"slug":39,"title":40,"language":41},"claude-sonnet-5-pricing-benchmarks-openrouter-en","Claude Sonnet 5 pricing and benchmarks on OpenRouter","en",[43,49,55,61,67,73],{"id":44,"slug":45,"title":46,"cover_image":47,"image_url":47,"created_at":48,"category":13},"eaa0b173-e497-4cef-8a18-662ff5da2186","meta-open-sources-30b-local-agent-macbook-zh","Meta開源30B本地智能體，MacBook也能跑","https:\u002F\u002Fxxdpdyhzhpamafnrdkyq.supabase.co\u002Fstorage\u002Fv1\u002Fobject\u002Fpublic\u002Fcovers\u002Finline-1787011393785-h6qz.png","2026-08-18T00:02:50.47166+00:00",{"id":50,"slug":51,"title":52,"cover_image":53,"image_url":53,"created_at":54,"category":13},"9279b1e3-2fd7-4943-9865-db65145a04fd","cognition-40b-valuation-funding-talks-zh","Cognition 估值恐衝 400 億美元","https:\u002F\u002Fxxdpdyhzhpamafnrdkyq.supabase.co\u002Fstorage\u002Fv1\u002Fobject\u002Fpublic\u002Fcovers\u002Finline-1786993379628-a01r.png","2026-08-17T19:02:28.084264+00:00",{"id":56,"slug":57,"title":58,"cover_image":59,"image_url":59,"created_at":60,"category":13},"617654a4-240e-4506-8af6-3b6fa8821e3d","shieldstral-turns-moderation-policy-into-one-model-zh","Shieldstral 把審核政策收成一個模型","https:\u002F\u002Fxxdpdyhzhpamafnrdkyq.supabase.co\u002Fstorage\u002Fv1\u002Fobject\u002Fpublic\u002Fcovers\u002Finline-1786975412576-sy8q.png","2026-08-17T14:02:54.280658+00:00",{"id":62,"slug":63,"title":64,"cover_image":65,"image_url":65,"created_at":66,"category":13},"f01d383b-1d9a-496b-8e2b-9bd4dd6aa079","claude-opus-5-benchmarks-developers-zh","Claude Opus 5 開發者基準與路由清單","https:\u002F\u002Fxxdpdyhzhpamafnrdkyq.supabase.co\u002Fstorage\u002Fv1\u002Fobject\u002Fpublic\u002Fcovers\u002Finline-1786930368498-wvik.png","2026-08-17T01:32:26.16127+00:00",{"id":68,"slug":69,"title":70,"cover_image":71,"image_url":71,"created_at":72,"category":13},"51bed36f-bfd7-45a0-9659-4e6901f981a5","claude-text-marking-all-products-cloud-access-zh","Claude文本標記擴大到全產品與雲端接入","https:\u002F\u002Fxxdpdyhzhpamafnrdkyq.supabase.co\u002Fstorage\u002Fv1\u002Fobject\u002Fpublic\u002Fcovers\u002Finline-1786906988205-mfro.png","2026-08-16T19:02:39.407337+00:00",{"id":74,"slug":75,"title":76,"cover_image":77,"image_url":77,"created_at":78,"category":13},"8c1f4524-a785-44bf-9940-00d3dee2d93b","anthropic-ipo-talks-skip-valuation-zh","Anthropic 先談上市，不先談估值","https:\u002F\u002Fxxdpdyhzhpamafnrdkyq.supabase.co\u002Fstorage\u002Fv1\u002Fobject\u002Fpublic\u002Fcovers\u002Finline-1786708972051-yjph.png","2026-08-14T12:02:28.025247+00:00",[80,85,90,95,100,105,110,115,120,125],{"id":81,"slug":82,"title":83,"created_at":84},"58b64033-7eb6-49b9-9aab-01cf8ae1b2f2","nvidia-rubin-six-chips-one-ai-supercomputer-zh","NVIDIA Rubin 把六顆晶片塞進 AI 機櫃","2026-03-26T07:18:45.861277+00:00",{"id":86,"slug":87,"title":88,"created_at":89},"0dcc2c61-c2a6-480d-adb8-dd225fc68914","march-2026-ai-model-news-what-mattered-zh","2026 年 3 月 AI 模型新聞重點","2026-03-26T07:32:08.386348+00:00",{"id":91,"slug":92,"title":93,"created_at":94},"214ab08b-5ce5-4b5c-8b72-47619d8675dd","why-small-models-are-winning-on-device-ai-zh","小模型為何吃下裝置端 AI","2026-03-26T07:36:30.488966+00:00",{"id":96,"slug":97,"title":98,"created_at":99},"785624b2-0355-4b82-adc3-de5e45eecd88","midjourney-v8-faster-images-higher-costs-zh","Midjourney V8 變快了，也變貴了","2026-03-26T07:52:03.562971+00:00",{"id":101,"slug":102,"title":103,"created_at":104},"9e1044b4-946d-47fe-9e2a-c2ee032e1164","xiaomi-mimo-v2-pro-1t-moe-agents-zh","小米 MiMo-V2-Pro 登場：1T MoE 模型","2026-03-28T03:06:19.002353+00:00",{"id":106,"slug":107,"title":108,"created_at":109},"c4b6186f-bd84-4598-997e-c6e31d543c0d","cursor-composer-2-agentic-coding-model-zh","Cursor Composer 2 走向代理式寫碼","2026-03-28T03:13:06.422716+00:00",{"id":111,"slug":112,"title":113,"created_at":114},"e112e76f-ec3b-408f-810e-e93ae21a888a","apple-siri-gemini-distilled-models-zh","Apple Siri 牽手 Gemini 的真相","2026-03-29T04:52:57.886544+00:00",{"id":116,"slug":117,"title":118,"created_at":119},"c679b51f-194a-463b-87fc-7695256ff752","mimo-v2-pro-vs-omni-vs-flash-2026-zh","MiMo V2 Pro、Omni、Flash 怎麼選","2026-04-02T01:18:43.576128+00:00",{"id":121,"slug":122,"title":123,"created_at":124},"3b988fd7-6749-4f01-ba25-c0ad7486dc31","z-ai-glm-5v-turbo-design2code-claude-zh","GLM-5V-Turbo 在 Design2Code 贏了…","2026-04-02T04:03:36.31741+00:00",{"id":126,"slug":127,"title":128,"created_at":129},"975a7aef-030e-41a6-9401-1c6a342be68e","april-2026-ai-model-releases-zh","2026年4月 AI 模型更新追蹤","2026-04-02T08:45:33.308563+00:00"]