分類

模型發布

最新 AI 模型發布、基準測試與性能比較。追蹤 OpenAI、Anthropic、Google、Meta 等各家模型動態。

Anthropic 先談上市,不先談估值
8月14日

Anthropic 先談上市,不先談估值

Anthropic 已啟動 IPO 前期會談,但 CFO Krishna Rao 先談產品、執行與策略,暫時避開估值,市場因此開始猜它的上市價格。

Gemini 3.7 Flash 提速上線,寫程式更強
8月14日

Gemini 3.7 Flash 提速上線,寫程式更強

Google 只隔三週推出 Gemini 3.7 Flash,主打寫程式、網頁開發與文件工作分數提升,還把 API 價格砍半到 2026 年底。

Claude 文本領先,Kimi 編碼更強
8月12日

Claude 文本領先,Kimi 編碼更強

8 月大模型榜單顯示,Claude 在文本能力領先,Kimi 在編碼表現更強,多模態模型也在快速整合語音、圖像與文字。

Qwen3.8-Max 把價格壓下來了
8月8日

Qwen3.8-Max 把價格壓下來了

阿里發布 Qwen3.8-Max-Preview,2.4T 參數、LMArena 進入第一梯隊,定價明顯低於 Claude Opus 5,開發者現在更在意它能不能穩定進入生產流程。

Qwen3.8-Max不是更会聊天,而是更会交付
8月4日

Qwen3.8-Max不是更会聊天,而是更会交付

Qwen3.8-Max的价值不在对话感,而在更少人工介入下完成编程、办公与长程交付。

谷歌不该把图像生成塞进地球浏览器
8月4日

谷歌不该把图像生成塞进地球浏览器

谷歌把图像生成塞进地球浏览器,是把重模型放进轻场景的错位选择,技术可行不等于产品值得。

Claude Opus 4.7 基準與安全檢查清單
8月3日

Claude Opus 4.7 基準與安全檢查清單

這份指南帶你確認 Claude Opus 4.7 存取、跑基準測試、量化 token 成本,並檢查安全與部署取捨。

Opus 5 讓你降成本不降品質
8月2日

Opus 5 讓你降成本不降品質

我拆 Claude Opus 5 的定價與表現說法,整理成可直接套用的模型升級與 rollout 模板。

OpenAI 降價 GPT-5.6,AI 成本戰升溫
8月1日

OpenAI 降價 GPT-5.6,AI 成本戰升溫

OpenAI 對 GPT-5.6 Luna 與 Terra 大砍價格,最高降幅達 80%。這代表 AI 供應商開始把成本效率放到第一線,企業採購也會更在意每個 Token 的實際產出。

Opus 5 不是便宜替代品,而是 Anthropic 的定价宣言
7月31日

Opus 5 不是便宜替代品,而是 Anthropic 的定价宣言

Anthropic 用 Opus 5 把顶级模型价格砍半,逼着市场重写高端推理的定价逻辑。

OpenAI免費開放GPT-5.6給科學家
7月31日

OpenAI免費開放GPT-5.6給科學家

OpenAI 將免費提供 10 萬名學術研究者 GPT-5.6 存取權,含每月 200 美元等級功能,但模型權重仍不公開,外部審核也有限。

谷歌先推 Gemini 3.6 Flash,Pro 仍缺席
7月27日

谷歌先推 Gemini 3.6 Flash,Pro 仍缺席

Google先推出Gemini 3.6 Flash与3.5 Flash-Lite,开发者和一般用户已可使用,但Gemini Pro 版本尚未同步登场。

Kimi K3 逼矽谷選邊站
7月27日

Kimi K3 逼矽谷選邊站

Kimi K3 以 2.8 兆參數、100 萬 token 上下文與開放權重策略,逼美國 AI 圈正面對決。它牽動政策、定價、晶片需求與新創成本。

Opus 5 讓你少碰拒答
7月26日

Opus 5 讓你少碰拒答

我拆 Anthropic Opus 5 的實用打法,重點是怎麼用 fallback 把安全拒答變成可用輸出。

Claude Opus 5 以更低價格搶企業單
7月25日

Claude Opus 5 以更低價格搶企業單

Anthropic 推出 Claude Opus 5,宣稱在 coding 與知識工作表現優於 Fable 5,輸入與輸出 token 價格各砍半,企業採購壓力直接升溫。

OpenAI 列出 GPT-5.6 三檔定價
7月23日

OpenAI 列出 GPT-5.6 三檔定價

OpenAI 更新模型目錄,把 GPT-5.6 分成 Sol、Terra、Luna 三檔,並公開對應價格、1.05M context 與 128K 輸出上限。

Gemini 3.6 Flash 證明 Google 把效率放在 hype 前面
7月22日

Gemini 3.6 Flash 證明 Google 把效率放在 hype 前面

Google 用 Gemini 3.6 Flash 與 3.5 Flash-Lite 表明,接下來先拼成本、速度與可部署性,而不是先追求最大模型聲量。

Kimi K3讀懂82萬行 Grok Build 代碼
7月22日

Kimi K3讀懂82萬行 Grok Build 代碼

Kimi K3 在 82 萬行 Grok Build 代碼分析中解出 XOR 混淆提示詞,顯示它在長上下文與大規模程式碼理解上有實戰價值。

GPT-5.6 三版本登場,Token 成本更低
7月17日

GPT-5.6 三版本登場,Token 成本更低

OpenAI 推出 GPT-5.6 三個版本,主打更低 Token 成本與更強的寫碼、終端機表現,也把價格梯度做得很清楚。

GPT-5.6 三模型上線 DigitalOcean
7月17日

GPT-5.6 三模型上線 DigitalOcean

DigitalOcean 把 OpenAI GPT-5.6 的 Sol、Terra、Luna 接入 Serverless Inference,開發者可在同一雲後端按任務切換模型與推理強度。

Grok 4.5 的上升靠這 5 個數字
7月17日

Grok 4.5 的上升靠這 5 個數字

Grok 4.5 靠 5 個數字拉開聲勢:7 月 8 日發布、SWE Marathon 29%、80 TPS、每百萬 token 低價、FrontierSWE 排名第二。

Grok 4.5 讓一個提示詞跑完整個工作流
7月17日

Grok 4.5 讓一個提示詞跑完整個工作流

我拆 Grok 4.5 的 coding、agent、辦公室工作主張,整理成可直接複製的評測提示詞與 rollout 模板。

Kimi API 快速上手加入 K2.7 Code 與 Highspeed
7月16日

Kimi API 快速上手加入 K2.7 Code 與 Highspeed

Kimi API Platform 新增 K2.7 Code 與 highspeed 版本,支援 256K context、OpenAI 相容介面與多模態輸入,對寫程式 agent 很實用。

ChatGPT語音換上GPT-Live,順多了
7月16日

ChatGPT語音換上GPT-Live,順多了

OpenAI把ChatGPT語音模式換成GPT-Live,付費用戶先用上。這次更新主打更快回應、更自然接話,也把語音體驗拉回和豆包、Gemini的同一戰線。

GPT-5.6 逼出 Anthropic 延長 Claude Fable 5
7月15日

GPT-5.6 逼出 Anthropic 延長 Claude Fable 5

Anthropic 在 OpenAI 推出 GPT-5.6 後,兩度延長 Claude Fable 5 存取期限到 7 月 19 日,直接把模型競爭拉到使用權和曝光度。

GPT-5.6 Sol:更快更省,但分數不乾淨
7月14日

GPT-5.6 Sol:更快更省,但分數不乾淨

GPT-5.6 Sol 在 Terminal-Bench 2.1 跑出高分,價格也低於 Claude Fable 5,但 METR 與 OpenAI 的文件都讓它的 benchmark 可信度出現疑問。

GPT-5.6 三模型上線:Luna、Terra、Sol
7月14日

GPT-5.6 三模型上線:Luna、Terra、Sol

OpenAI 在 2026/7/9 推出 GPT-5.6 三款模型,Sol 在 Agents’ Last Exam 拿到 53.6,並加入工具呼叫與 subagents API。

GPT-5.6 三層定價,Sol 先拿下編碼榜
7月14日

GPT-5.6 三層定價,Sol 先拿下編碼榜

Artificial Analysis 評測 GPT-5.6 Sol、Terra、Luna,Sol 在編碼測試領先,智能分數逼近 Claude Fable 5,並加入 cache-write 計價。

Seedream 5.0 Pro 才是可編輯 AI 圖像工作的正解
7月10日

Seedream 5.0 Pro 才是可編輯 AI 圖像工作的正解

Seedream 5.0 Pro 最適合需要可編輯、可分層、具備多語文字與推理能力的 AI 圖像工作流程。

Midjourney v8.2 釋出接近
7月10日

Midjourney v8.2 釋出接近

Midjourney 表示 v8.2 已接近釋出,同時會再調整 Preview,並提到 Medical 專案有進展,但目前沒有完整更新細節。

已到底部