大酷樂
  • 汽車
  • 理财
  • 軍事
  • 科技
  • 遊戲
  • 互聯網
  • 娛樂
  • 财經
  • 科學
  • 社會
  • 親子
  • 電影
  • 健康
  • 教育
  1. 首頁
  2. 财經

DeepSeek甩出了一張“王炸”

2024-12-29 简体 HK SG TW

今天小編分享的财經經驗:DeepSeek甩出了一張“王炸”,歡迎閱讀。

出品|虎嗅科技組

作者|餘楊

編輯|苗正卿

頭圖|《賭神》劇照

12 月 26 日消息,國產大模型 DeepSeek 推出 DeepSeek-V3,一個強大的混合專家(Mixture-of-Experts, MoE)語言模型。主要的技術迭代是 671B 的 MoE,37B 的激活參數,在 14.8 萬億個高質量 token 上進行了預訓練。

AI 圈表示," 聖誕節真的來了 "。

翻譯翻譯,首先,從訓練時間看,正如 DeepSeek 在發布報告中指出的那樣," 盡管其表現出色,DeepSeek-V3 的完整訓練僅需 2.788M H800 GPU 小時。"

打個比方,如果對标 Llama 3 系列模型,其計算預算為 3930 萬 H100 GPU Hours —— 大約可以訓練 DeepSeek-V3 十五次。

從成本上看,如果我們假設 H800 GPU 的租金為每 GPU 小時 2 美元,DeepSeek-V3 的總訓練成本僅為 557.6 萬美元。

不僅如此,在最新發布的技術報告裡,經過與 DeepSeek-V2.5、Qwen2.5-72B-Inst、Llama-3.1-405B-Inst、GPT-4o-0513 和 Claude-3.5-Sonnet-1022 幾個模型的跑分, DeepSeek-V3 在多個性能基準測試中表現出色。在 MATH500、AIME2024 和 Codeforces 三個維度更是遙遙領先,數學和編程能力極強,一度超過 GPT-4o 和 Claude 3.5 Sonnet 這兩大領先的閉源模型。雖然在某些語言理解和軟體工程任務中稍有遜色,但也是 TOP2 傑出人士選手。

DeepSeek 自言,這得益于采用了 Multi-head Latent Attention ( MLA ) 和 DeepSeek MoE 架構,實現了高效的推理和經濟高效的訓練。又引入了輔助損失自由負載平衡策略和多 token 預測訓練目标,提升了模型性能。同時,在 14.8 萬億個高質量 token 上進行了預訓練時,通過監督微調和強化學習階段充分挖掘了其潛力。

綜合評估顯示,DeepSeek-V3 優于其他開源模型,性能接近領先的閉源模型。并且,訓練過程非常穩定,沒有遇到不可恢復的損失峰值或回滾。相比之下,在同一天,ChatGPT 再次宕機,修復時間尚未确定。

Meta AI 研究科學家田淵棟在 X 上對 DeepSeek-V3 " 極有限的預算 " 和 " 強勁的表現 " 深感驚喜。

曾為 Glean 和 Google Search 的創始團隊成員的 VC Deedy 更是将 DeepSeek-V3 贊為 " 世界上最好的開源大模型 "。

DeepSeek-V3 的基礎模型以英語和中文為主的多語言語料庫上進行預訓練,因此主要在一系列以英語和中文為主的基準測試上評估其性能,同時也在一個多語言基準測試上進行評估。而基于其内部集成的 HAI-LLM 框架,具體跑分如下:

如上可以看到 V3 在英語、編程、數學、中文、多語言幾個維度的表現。

英語(English):DeepSeek-V3 Base 在大多數測試中表現最佳,例如在 BBH ( EM ) 、MMLU ( EM ) 、MMLU-Redux ( EM ) 、DROP ( F1 ) 、ARC-Easy ( EM ) 、ARC-Challenge ( EM ) 、HellaSwag ( EM ) 、PIQA ( EM ) 、WinoGrande ( EM ) 、TriviaQA ( EM ) 和 AGIEval ( EM ) 等測試中。在 Pile-test ( BPB ) 基準測試中,DeepSeek-V3 Base 的得分為 0.548,也略高于其他模型。

代碼(Code):DeepSeek-V3 Base 在 HumanEval ( Pass@1 ) 、MBPP ( Pass@1 ) 、LiveCodeBench-Base ( Pass@1 ) 、CRUXEval-I ( EM ) 和 CRUXEval-O ( EM ) 等測試中表現突出。

數學(Math):DeepSeek-V3 Base 在 GSM8K ( EM ) 、MATH ( EM ) 、MGSM ( EM ) 和 CMath ( EM ) 等測試中表現優異。

中文(Chinese):DeepSeek-V3 Base 在 CLUEWSC ( EM ) 、C-Eval ( EM ) 、CMMLU ( EM ) 、CMRC ( EM ) 、C3 ( EM ) 和 CCPM ( EM ) 等測試中表現良好。

多語言(Multilingual):DeepSeek-V3 Base 在 MMMLU-non-English ( EM ) 測試中表現最佳。

由于 DeepSeek" 大方 " 開源,Open AI 水靈靈地被網友 cue 進行橫向對比,有一種被 push 的支配感。

不少玩家還在 X 上分享了自己的使用體驗,認為 DeepSeek-V3 很 " 聰明 ",并對 Deepseek 團隊表示極大的尊重。

DeepSeek 是一家創新型科技公司,長久以來專注于開發先進的大語言模型(LLM)和相關技術,由知名私募巨頭幻方量化孕育而生,作為大廠外唯一一家儲備萬張 A100 芯片的公司,幻方量化為 DeepSeek 的技術研發提供了強大的硬體支持。

早在通過開源大模型如 DeepSeek Coder 等,DeepSeek 就展示了在人工智能技術領網域的實力。DeepSeek V2 模型的發布,更是提供了一種史無前例的性價比,推動了中國大模型價格戰的發展,并因其創新的 MLA 架構和 DeepSeekMoESparse 結構而受到業界的廣泛關注。

DeepSeek 被矽谷譽為 " 來自東方的神秘力量 ",其 V2 模型論文在當時即被認為可能是今年最好的一篇。半年後,DeepSeek 帶着 V3 再次登場,用行動說明,中國大模型創業者,也可以加入到這場全球技術創新的 AI 競賽中。

熱門排行
  • 王治郅:楊瀚森主要的問題是速度 他的速度跟不上現代籃球的節奏 王治郅:楊瀚森主要的問題是速度 他的速度跟 郟君昊 | 2025-05-05
  • 貿易戰燒進電影院:特朗普拟重稅打擊外國電影 逼好萊塢等回美拍片 貿易戰燒進電影院:特朗普拟重稅打擊外國電影 習又夏 | 2025-05-05
  • 貸款追高炒黃金的人後悔了!有人一天虧掉6年工資,賣掉舍不得,不賣扛不住 貸款追高炒黃金的人後悔了!有人一天虧掉6年 寸飛蘭 | 2025-05-05
  • 手機電池突破8000mAh?矽碳技術的回旋镖:「折壽」換容量 手機電池突破8000mAh?矽碳技術的回旋镖:「折 衛青柏 | 2025-05-05
  • 貸款追高炒黃金的人後悔了!有人一天虧掉6年工資,賣掉舍不得,不賣扛不住 貸款追高炒黃金的人後悔了!有人一天虧掉6年 繁綺文 | 2025-05-05
  • 任天堂對Genki提起Switch 2商标侵權訴訟,後者回應稱将嚴肅對待 任天堂對Genki提起Switch 2商标侵權訴訟,後 郜萌運 | 2025-05-05
  • 哪吒汽車APP和官網恢復正常 知情人士:之前斷網因流量欠費 哪吒汽車APP和官網恢復正常 知情人士:之前斷 袁曼雁 | 2025-05-05
  • 極越汽車 CEO 夏一平名下青島/義烏兩家公司被列入經營異常 極越汽車 CEO 夏一平名下青島/義烏兩家公司 集玲琳 | 2025-05-05
  • 全國經濟第一大省明确,推動組建農商聯合銀行 全國經濟第一大省明确,推動組建農商聯合銀行 佼昌翰 | 2025-05-05
  • 桑保利:亞馬爾有配合意識&有點像梅西 姆巴佩更專注進球&更像C羅 桑保利:亞馬爾有配合意識&有點像梅西 姆巴佩 甄正浩 | 2025-05-05
  • 高露現身上海虹橋機場 黑色外套點綴亮色愛心裝飾俏皮亮眼 高露現身上海虹橋機場 黑色外套點綴亮色愛 惠惠君 | 2023-05-02
  • 《歧路旅人2》:向光而生 《歧路旅人2》:向光而生 衛青柏 | 2023-05-02
  • vivo X90S曝光:處理器更新為天玑9200+ 安卓最強芯 vivo X90S曝光:處理器更新為天玑9200+ 安卓最 袁曼雁 | 2023-05-05
  • “懶癌”發病率上升,定期體檢别忽視 “懶癌”發病率上升,定期體檢别忽視 幸聽楓 | 2023-05-02
  • 曹操墓,裡面都有啥? 曹操墓,裡面都有啥? 衛青柏 | 2023-05-02
  • 宋慧喬獲百想視後 韓素希發圖手動加愛心表情慶祝 宋慧喬獲百想視後 韓素希發圖手動加愛心表 賁芳蕤 | 2023-05-02
  • 十年了,他們終于要HE! 十年了,他們終于要HE! 惠惠君 | 2023-05-07
  • 中央部署經濟工作,釋放5大信号 中央部署經濟工作,釋放5大信号 郜萌運 | 2023-05-02
  • 高德上線手機彎道會車預警功能 高德上線手機彎道會車預警功能 習又夏 | 2023-05-02
  • 陳自瑤抱病為愛女做蛋糕慶生,王浩信點贊沒露面 陳自瑤抱病為愛女做蛋糕慶生,王浩信點贊沒露 賁芳蕤 | 2023-05-02
  • 等比例長大的童星,李蘭迪算一個 等比例長大的童星,李蘭迪算一個 郟君昊 | 2023-05-02
  • 《雲襄傳》終于抬上來啦,男O女A讓人好上頭! 《雲襄傳》終于抬上來啦,男O女A讓人好上頭! 集玲琳 | 2023-05-02
  • 高端國產車:軍車血統,目前電動車越野的“天花板”? 高端國產車:軍車血統,目前電動車越野的“天花 謝飛揚 | 2023-05-02
  • 這些被抓來做實驗的流浪狗,最終拯救了無數糖尿病人 這些被抓來做實驗的流浪狗,最終拯救了無數糖 集玲琳 | 2023-05-02
  • 21家A股遊戲公司2022年收入651億 今年“遊戲+AI”能否逆風翻盤? 21家A股遊戲公司2022年收入651億 今年“遊 衛青柏 | 2023-05-04
  • 與周立波夫婦鬧糾紛成老賴,唐爽被司法拘留15日 與周立波夫婦鬧糾紛成老賴,唐爽被司法拘留15 寸飛蘭 | 2023-05-05
  • 普京籤署總統令,批準對俄刑法典相關法條的修正案 普京籤署總統令,批準對俄刑法典相關法條的修 集玲琳 | 2023-05-02
  • 信用風險釋放趨緩,結構性風險需重點關注 ——2023年一季度債市信用風險回顧與下階段展望 信用風險釋放趨緩,結構性風險需重點關注 — 袁曼雁 | 2023-05-02
  • 3699起 聯想小新mini主機上架 13代酷睿标壓處理器 3699起 聯想小新mini主機上架 13代酷睿标壓 習又夏 | 2023-05-05
  • 中銀證券給予南京銀行增持評級 中銀證券給予南京銀行增持評級 袁曼雁 | 2023-05-03
  • 解除資格!停止一切合作 解除資格!停止一切合作 佼昌翰 | 2023-05-02
  • 前董事長被免,天山生物全面進入“中植系”時代?股價曾在一月内暴漲超400% 前董事長被免,天山生物全面進入“中植系”時 惠惠君 | 2023-05-02
  • 瘋成這樣,怎麼還能被全網吹捧? 瘋成這樣,怎麼還能被全網吹捧? 郜萌運 | 2023-05-02
  • 狂吼11次“讓一下”!交警咆哮開道嘶吼到吐 狂吼11次“讓一下”!交警咆哮開道嘶吼到吐 寸飛蘭 | 2023-05-03
  • 摩根大通收購美國第一共和銀行 摩根大通收購美國第一共和銀行 謝飛揚 | 2023-05-02
  • 台劇赢麻了,又來一部8.9 台劇赢麻了,又來一部8.9 衛青柏 | 2023-05-02
  • 事關農村土地承包和農民權益,《農村土地承包合同管理辦法》5月1日起施行 事關農村土地承包和農民權益,《農村土地承包 郟君昊 | 2023-05-02
  • 下降45分,上漲35分!34所自劃線院校復試分數線漲幅匯總 下降45分,上漲35分!34所自劃線院校復試分數線 袁曼雁 | 2023-05-07
  • "三高"已盯上青少年,做好這件事是關鍵 "三高"已盯上青少年,做好這件事是關鍵 習又夏 | 2023-05-05
  • 五一檔沒一個能打的 五一檔沒一個能打的 集玲琳 | 2023-05-05
  • 恐怖韓劇下神壇,這次膽小可入 恐怖韓劇下神壇,這次膽小可入 袁曼雁 | 2023-05-05
  • 這劇是不是用ChatGPT寫的呀? 這劇是不是用ChatGPT寫的呀? 惠惠君 | 2023-05-02
  • 200戶連夜疏散,原因讓人憤怒!“損失超一億”,官方通報 200戶連夜疏散,原因讓人憤怒!“損失超一億”, 袁曼雁 | 2023-05-03
  • 性騷擾慣犯,滾出娛樂圈 性騷擾慣犯,滾出娛樂圈 謝飛揚 | 2023-05-05
  • 48歲何炅自曝已老花眼,黃磊睡前認老,《向往的生活》證實将停辦 48歲何炅自曝已老花眼,黃磊睡前認老,《向往的 佼昌翰 | 2023-05-02
  • 一個《長月燼明》倒了,《狐妖》《長相思》《與鳳行》…在路上了 一個《長月燼明》倒了,《狐妖》《長相思》《 惠惠君 | 2023-05-02
  • 當年輕人開始不随份子錢 當年輕人開始不随份子錢 袁曼雁 | 2023-05-02
  • 張天愛假期曬“酷”存照 卷發披肩穿黑色吊帶裙大秀好身材 張天愛假期曬“酷”存照 卷發披肩穿黑色吊 嬴覓晴 | 2023-05-02
  • 畢滢用8年時間成功逼宮?曾被傳已婚生子的她,不容小觑 畢滢用8年時間成功逼宮?曾被傳已婚生子的她, 幸聽楓 | 2023-05-03
  • 宋慧喬獲視後首次曬照,拿獎杯笑容溫柔 宋慧喬獲視後首次曬照,拿獎杯笑容溫柔 郜萌運 | 2023-05-02

©2022 大酷樂 版權所有

隱私政策 | 服務條款 | 聯繫我們