返回首頁

標籤

DeepSeek

DeepSeek 代表新一輪開源與低成本大模型競爭,牽動推論效率、KV cache、GPU 配置與雲端部署成本。從模型架構到 NVIDIA 供應鏈,它正在改寫 AI 基礎設施的估值與選型。

13 篇文章

OpenCode 支援多家模型,切換更省事
工具應用/8月10日

OpenCode 支援多家模型,切換更省事

OpenCode 新增 DeepSeek V4 Flash、GLM-5.2、Qwen3.8 Max、GPT 5.6 Luna 支援,讓開發者更容易在不同 API 之間切換。

DeepSeek 接入 Codex 後,AI 編程成本必須重算
工具應用/8月10日

DeepSeek 接入 Codex 後,AI 編程成本必須重算

DeepSeek 接入 Codex 把 AI 編程的成本門檻壓低了,迫使團隊重新計算:哪些任務該由代理默認接手,哪些才值得用高價模型。

DeepSeek V4 Flash 讓 Agent 便宜跑
工具應用/8月4日

DeepSeek V4 Flash 讓 Agent 便宜跑

我拆解 DeepSeek V4 Flash 的定價、API 相容與 Codex 適配,整理成可直接複製的 Agent 接入模板。

中國正在贏得 AI 冷戰,因為它在建整個堆疊,不是在做展示
產業動態/7月12日

中國正在贏得 AI 冷戰,因為它在建整個堆疊,不是在做展示

中國在 AI 競爭中領先的關鍵,不是單一模型或跑分,而是從晶片、算力到模型與分發的整體堆疊。

DeepSeek 低價策略改寫 AI 定價
產業動態/6月27日

DeepSeek 低價策略改寫 AI 定價

5 個面向看 DeepSeek 如何用免費、低 API 價格、開放權重、數學模型與市場壓力改寫 AI 定價。

中國 AI 轉向:開源、效率、出海
產業動態/6月17日

中國 AI 轉向:開源、效率、出海

中國 AI 正改走低成本、開源與海外商用路線。DeepSeek、Qwen 等模型帶動全球使用,企業也把重心放到代理工具與出海銷售。

中國開源 AI 正逼美國改打法
產業動態/6月17日

中國開源 AI 正逼美國改打法

中國 AI 實驗室主打開源模型,正在壓低推理成本,也逼 OpenAI、Anthropic 這類美國閉源 лаборатory 重新想商業模式。

10 款可本地跑的開源 LLM,2026 這樣選
產業動態/6月12日

10 款可本地跑的開源 LLM,2026 這樣選

10 款可本地部署的開源 LLM,從 8GB 到 136GB VRAM 都有對應選擇,適合比對推理、寫程式、長上下文與代理任務。

中國開源 AI 模型已經定調,西方團隊該把它當新基準
產業動態/6月9日

中國開源 AI 模型已經定調,西方團隊該把它當新基準

中國實驗室已經領跑開源 AI,西方團隊應把這件事視為新的起跑線,而不是短期波動。

5 個步驟把 Codex 接到 DeepSeek
產業動態/6月7日

5 個步驟把 Codex 接到 DeepSeek

5 步完成 Codex 透過 DeepSeek 的接入,含 CCX、CC Switch 與重啟檢查細節。

DeepSeek 之後,NVIDIA 股價會回來嗎
產業動態/4月3日

DeepSeek 之後,NVIDIA 股價會回來嗎

DeepSeek 讓市場重新算 AI 成本,但 NVIDIA 仍握有 GPU、CUDA 與資料中心供應鏈。本文用數字、競品與產業脈絡,拆解股價能否回升。

NVIDIA B300 對 H200:DeepSeek 實…
產業動態/4月3日

NVIDIA B300 對 H200:DeepSeek 實…

B300 有 288GB HBM3e 和 8TB/s 頻寬。這篇直接比 H200,拆解 DeepSeek 推論、KV cache、雲端成本與部署取捨。

Sebastian Raschka 的 LLM 架構圖鑑
技術研究/4月2日

Sebastian Raschka 的 LLM 架構圖鑑

Raschka 的 LLM Architecture Gallery 把 GPT-2、Llama 3、OLMo 2、DeepSeek、Qwen 等模型的層數、注意力與 KV cache 數字攤開來比,工程師一眼就能看出部署差異。