IT之家 2 月 27 日消息,據路透社 2 月 26 日報道,兩位了解情況的消息人士表示,DeepSeek 在即將進行重大模型更新之前,未向美國芯片製造商展示其即將推出的旗艦模型,這打破了行業標準做法。
相反,DeepSeek V4 向國內供應商 —— 包括華為技術有限公司 —— 提供了早期訪問權限。
報道提到,AI 開發者通常會將主要模型的預發布版本分享給英偉達和 AMD 等芯片製造商,以確保其軟件在廣泛使用的硬件上高效運行。DeepSeek 之前曾與英偉達的技術人員密切合作。
對於其即將推出的模型,DeepSeek 沒有向英偉達和 AMD 提供訪問權限,而是給予包括華為在內的中國廠商幾周的時間來適配其芯片。
英偉達和 AMD 拒絕評論。DeepSeek 和華為沒有回應評論請求。
消息源 @legit_api 於 2 月 26 日在 X 平台發布推文,報道稱 DeepSeek 正在測試 V4 Lite 模型,代號為“Sealion-lite”,上下文窗口為 100 萬 tokens,並是原生支持多模態推理。
IT之家注意到,本月早些時候,DeepSeek 更新之後開始灰度測試最高 1M(百萬)Token 的上下文長度與此同時,最新 DeepSeek 的知識庫已經更新到 2025 年 5 月,非聯網狀態下可準確輸出 2025 年 4 月的新聞。


