模型發布
最新 AI 模型發布、基準測試與性能比較。追蹤 OpenAI、Anthropic、Google、Meta 等各家模型動態。

Anthropic 先談上市,不先談估值
Anthropic 已啟動 IPO 前期會談,但 CFO Krishna Rao 先談產品、執行與策略,暫時避開估值,市場因此開始猜它的上市價格。

Gemini 3.7 Flash 提速上線,寫程式更強
Google 只隔三週推出 Gemini 3.7 Flash,主打寫程式、網頁開發與文件工作分數提升,還把 API 價格砍半到 2026 年底。

Claude 文本領先,Kimi 編碼更強
8 月大模型榜單顯示,Claude 在文本能力領先,Kimi 在編碼表現更強,多模態模型也在快速整合語音、圖像與文字。

Qwen3.8-Max 把價格壓下來了
阿里發布 Qwen3.8-Max-Preview,2.4T 參數、LMArena 進入第一梯隊,定價明顯低於 Claude Opus 5,開發者現在更在意它能不能穩定進入生產流程。

Qwen3.8-Max不是更会聊天,而是更会交付
Qwen3.8-Max的价值不在对话感,而在更少人工介入下完成编程、办公与长程交付。

谷歌不该把图像生成塞进地球浏览器
谷歌把图像生成塞进地球浏览器,是把重模型放进轻场景的错位选择,技术可行不等于产品值得。

Claude Opus 4.7 基準與安全檢查清單
這份指南帶你確認 Claude Opus 4.7 存取、跑基準測試、量化 token 成本,並檢查安全與部署取捨。

Opus 5 讓你降成本不降品質
我拆 Claude Opus 5 的定價與表現說法,整理成可直接套用的模型升級與 rollout 模板。

OpenAI 降價 GPT-5.6,AI 成本戰升溫
OpenAI 對 GPT-5.6 Luna 與 Terra 大砍價格,最高降幅達 80%。這代表 AI 供應商開始把成本效率放到第一線,企業採購也會更在意每個 Token 的實際產出。

Opus 5 不是便宜替代品,而是 Anthropic 的定价宣言
Anthropic 用 Opus 5 把顶级模型价格砍半,逼着市场重写高端推理的定价逻辑。

OpenAI免費開放GPT-5.6給科學家
OpenAI 將免費提供 10 萬名學術研究者 GPT-5.6 存取權,含每月 200 美元等級功能,但模型權重仍不公開,外部審核也有限。

谷歌先推 Gemini 3.6 Flash,Pro 仍缺席
Google先推出Gemini 3.6 Flash与3.5 Flash-Lite,开发者和一般用户已可使用,但Gemini Pro 版本尚未同步登场。

Kimi K3 逼矽谷選邊站
Kimi K3 以 2.8 兆參數、100 萬 token 上下文與開放權重策略,逼美國 AI 圈正面對決。它牽動政策、定價、晶片需求與新創成本。

Opus 5 讓你少碰拒答
我拆 Anthropic Opus 5 的實用打法,重點是怎麼用 fallback 把安全拒答變成可用輸出。

Claude Opus 5 以更低價格搶企業單
Anthropic 推出 Claude Opus 5,宣稱在 coding 與知識工作表現優於 Fable 5,輸入與輸出 token 價格各砍半,企業採購壓力直接升溫。

OpenAI 列出 GPT-5.6 三檔定價
OpenAI 更新模型目錄,把 GPT-5.6 分成 Sol、Terra、Luna 三檔,並公開對應價格、1.05M context 與 128K 輸出上限。

Gemini 3.6 Flash 證明 Google 把效率放在 hype 前面
Google 用 Gemini 3.6 Flash 與 3.5 Flash-Lite 表明,接下來先拼成本、速度與可部署性,而不是先追求最大模型聲量。

Kimi K3讀懂82萬行 Grok Build 代碼
Kimi K3 在 82 萬行 Grok Build 代碼分析中解出 XOR 混淆提示詞,顯示它在長上下文與大規模程式碼理解上有實戰價值。

GPT-5.6 三版本登場,Token 成本更低
OpenAI 推出 GPT-5.6 三個版本,主打更低 Token 成本與更強的寫碼、終端機表現,也把價格梯度做得很清楚。

GPT-5.6 三模型上線 DigitalOcean
DigitalOcean 把 OpenAI GPT-5.6 的 Sol、Terra、Luna 接入 Serverless Inference,開發者可在同一雲後端按任務切換模型與推理強度。

Grok 4.5 的上升靠這 5 個數字
Grok 4.5 靠 5 個數字拉開聲勢:7 月 8 日發布、SWE Marathon 29%、80 TPS、每百萬 token 低價、FrontierSWE 排名第二。

Grok 4.5 讓一個提示詞跑完整個工作流
我拆 Grok 4.5 的 coding、agent、辦公室工作主張,整理成可直接複製的評測提示詞與 rollout 模板。

Kimi API 快速上手加入 K2.7 Code 與 Highspeed
Kimi API Platform 新增 K2.7 Code 與 highspeed 版本,支援 256K context、OpenAI 相容介面與多模態輸入,對寫程式 agent 很實用。

ChatGPT語音換上GPT-Live,順多了
OpenAI把ChatGPT語音模式換成GPT-Live,付費用戶先用上。這次更新主打更快回應、更自然接話,也把語音體驗拉回和豆包、Gemini的同一戰線。

GPT-5.6 逼出 Anthropic 延長 Claude Fable 5
Anthropic 在 OpenAI 推出 GPT-5.6 後,兩度延長 Claude Fable 5 存取期限到 7 月 19 日,直接把模型競爭拉到使用權和曝光度。

GPT-5.6 Sol:更快更省,但分數不乾淨
GPT-5.6 Sol 在 Terminal-Bench 2.1 跑出高分,價格也低於 Claude Fable 5,但 METR 與 OpenAI 的文件都讓它的 benchmark 可信度出現疑問。

GPT-5.6 三模型上線:Luna、Terra、Sol
OpenAI 在 2026/7/9 推出 GPT-5.6 三款模型,Sol 在 Agents’ Last Exam 拿到 53.6,並加入工具呼叫與 subagents API。

GPT-5.6 三層定價,Sol 先拿下編碼榜
Artificial Analysis 評測 GPT-5.6 Sol、Terra、Luna,Sol 在編碼測試領先,智能分數逼近 Claude Fable 5,並加入 cache-write 計價。

Seedream 5.0 Pro 才是可編輯 AI 圖像工作的正解
Seedream 5.0 Pro 最適合需要可編輯、可分層、具備多語文字與推理能力的 AI 圖像工作流程。

Midjourney v8.2 釋出接近
Midjourney 表示 v8.2 已接近釋出,同時會再調整 Preview,並提到 Medical 專案有進展,但目前沒有完整更新細節。