大酷樂
  • 汽车
  • 理财
  • 军事
  • 科技
  • 游戏
  • 互联网
  • 娱乐
  • 财经
  • 科学
  • 社会
  • 亲子
  • 电影
  • 健康
  • 教育
  1. 首頁
  2. 科技

一手实测「豆包」深度思考模式:能超越 DeepSeek 吗?

2025-02-26 简体 HK SG TW

今天小编分享的科技经验:一手实测「豆包」深度思考模式:能超越 DeepSeek 吗?,欢迎阅读。

字节跳动旗下 AI 助手豆包正在小范围测试深度思考模型,据豆包相关负责人对极客公园表示,当前测试的是自家深度思考模型的不同实验版本。

另外有报道称,豆包正在测试的深度思考模型是基于豆包 1.5 基座模型研发。

其实此前在 1 月中旬,在豆包大模型团队发布豆包 1.5Pro 时,就已宣布了深度推理模型 Doubao-1.5-pro-AS1-Preview 的存在,并称「在完全不使用其他模型数据的条件下,通过 RL 算法的突破和工程优化,充分发挥 Test Time Scaling 的算力优势,完成了 RL Scaling ,研发了 Doubao 深度思考模式。」

极客公园实测发现,与豆包对话时后者生成的答案确实有开始显示推理过程的思维链,不过并不稳定出现。目前在豆包对话页面也尚未出现「深度思考」功能的入口。

从 2 月 22 日开始,豆包就被腾讯旗下的 AI 应用「腾讯元宝」压了一个身位,位居中国区苹果应用商店免费 APP 下载排行榜第三位(第一名还是 deepseek ) ,在腾讯、百度多个应用接入 deepseek 后,字节豆包会如何处之就成为大家关注的焦点,如今答案正在显现。

1 豆包也上「深度思考」了?

最早具备深度思考能力的模型是 OpenAI 于 2023 年 12 月推出的 o1 系统,但其采用闭源策略而且仅限付费用户使用(每月 200 美元)。而 DeepSeek 则通过开源策略、成本降低以及互動创新,成为首个将深度思考能力大规模普及的 AI 公司—— DeepSeek 于 2024 年 11 月 20 日发布 R1-Lite-Preview,成为国内首个对标 o1 的推理模型,并在 2025 年 1 月 20 日开源了 R1 模型。

R1 模型的创新点在于:透明化思维链;展示完整的推理过程,包括自我质疑、假设验证等拟人化思考路径;低成本与开源;R1 模型的推理成本仅为 OpenAI o1 的 1/27,且代码完全开放。

DeepSeek 的深度思考模式是一种通过显性化 AI 模型的推理过程来增强用户理解的功能,思维链(Chain of Thought, CoT)是支撑这一模式的核心技术。

简单来说,深度思考模式可以让用户直观看到模型的思考过程,这中间涉及思维链的展示,也就是 COT(Chain of Thought)——思维链是模拟出来的,通过训练让模型输出中间步骤,比如自我质疑和反思,虽然只是文字序列,但看起来像人类的思考过程。

在深度思考模式下,用户不仅能看到 AI 的最终答案,还能观察到模型解决问题的完整逻辑链条,包括自我质疑、假设验证、错误修正等步骤。比如,在解决数学题时,模型会展示其从问题拆解、多方法验证到最终结论的全过程。

结合实时联网功能后,模型可抓取最新信息并进行逻辑整合。25 日,Anthropic 发布了 Claude 3.7 Sonnet 混合推理模型,阿里云 Qwen 推理模型「QwQ-Max 预览版」也亮相了,我让豆包评价了一下这两款推理模型:

可以看到豆包搜到 9 篇资料并进行了「深入思考」|图片来源:极客公园

豆包展示了思考过程|图片来源:极客公园

思考完毕的豆包输出了对这两款模型的评价|图片来源:极客公园

思考过程的展示,让用户能够清晰地看到模型的推理步骤,而不仅仅是最终结果,这样一来,用户能够感受到模型的决策是有依据的,对模型输出的结果也会更有信任感。

2 豆包 vs deepseek,各有千秋

因为还在测试中,目前在豆包对话页面暂未显示「深度思考」功能的入口,输入消息时也没有像其他接入 deepseek 的产品一样有选择框可以选择是否开启「深度思考」功能,只是被灰度到的用户在问一些问题时会触发该功能。

我拿几个问题同时问了一下豆包和 deepseek,看下两者在「深度思考」上会有哪些不同表现。

经典的数学问题:「9.11 和 9.9 谁大」

先看下豆包的思考过程:

先说一下,在测试中,我发现豆包的「深度思考」模式出现得并不稳定,在第一次输入「9.11 和 9.9 谁大」后,它只是简单地回应了我一下:

图片来源:极客公园

但在我又输入了一遍「9.11 和 9.9 谁大」想试试会不会触发「深度思考」模式时,还真出现了:

豆包详细地考虑了为什么我会第二次问它这个问题……|图片来源:极客公园

可以看到,虽然豆包意识到刚刚已经回答过我,但它还是贴心地考虑了多种也许我没理解前面答案的可能性,然后再给出判断方法最后输出结果。

再看一下 deepseek 的思考过程:

可以看出,虽然这是一个「看起来很简单」的问题,deepseek 的思考过程同样很详细,要比豆包的思考过程更全面。

在这个简单数学题上,豆包和 deepseek 都遵循了小数比较的基本规则,并采用多种方法验证;不同点在于豆包注重教学引导和考虑到用户可能的误解,而 DeepSeek 则更现自我质疑和反复验证,思考过程更复杂。

哲学问题:意识的本质是什么?AI 会获得自我意识吗?

先来看豆包的回答:

再来看看 deepseek 的回答:

可以看出,DeepSeek 的回答分为科学理论、AI 意识路径、伦理框架和解决路径四个部分,引用了神经科学、量子理论等,还提到了法律案例和具体数据;而豆包的回答更偏向哲学理论分类,列举了物理主义、二元论等,并讨论了支持与反对 AI 权利的观点,不过没有深入技术细节。

两者都承认意识本质尚无共识,也都提到了哲学和科学理论、伦理问题,不同则在于深度和技术细节,DeepSeek 更技术导向,涉及神经形态计算、量子封印技术等,而豆包更侧重哲学流派和现有伦理指南。

通过本次实测,我们看到了豆包在深度思考模式上的初步表现,虽然目前处于测试阶段,且功能的稳定性和入口尚未完全开放,但其对推理过程的初步展示已为用户带来了更直观的理解路径。

熱門排行
  • 王治郅:杨瀚森主要的问题是速度 他 王治郅:杨瀚森主要的问题是速度 他 郟君昊 | 2025-05-05
  • 贸易战烧进电影院:特朗普拟重税打击 贸易战烧进电影院:特朗普拟重税打击 習又夏 | 2025-05-05
  • 贷款追高炒黄金的人后悔了!有人一天 贷款追高炒黄金的人后悔了!有人一天 寸飛蘭 | 2025-05-05
  • 手机电池突破8000mAh?硅碳技术的回 手机电池突破8000mAh?硅碳技术的回 衛青柏 | 2025-05-05
  • 贷款追高炒黄金的人后悔了!有人一天 贷款追高炒黄金的人后悔了!有人一天 繁綺文 | 2025-05-05
  • 任天堂对Genki提起Switch 2商标侵 任天堂对Genki提起Switch 2商标侵 郜萌運 | 2025-05-05
  • 哪吒汽车APP和官网恢复正常 知情人 哪吒汽车APP和官网恢复正常 知情人 袁曼雁 | 2025-05-05
  • 极越汽车 CEO 夏一平名下青岛/义乌 极越汽车 CEO 夏一平名下青岛/义乌 集玲琳 | 2025-05-05
  • 全国经济第一大省明确,推动组建农商 全国经济第一大省明确,推动组建农商 佼昌翰 | 2025-05-05
  • 桑保利:亚马尔有配合意识&有点像梅 桑保利:亚马尔有配合意识&有点像梅 甄正浩 | 2025-05-05
  • 高露现身上海虹桥机场 黑色外套点缀亮色爱心装饰俏皮亮眼 高露现身上海虹桥机场 黑色外套点缀亮色爱心装饰俏皮亮眼 惠惠君 | 2023-05-02
  • 《歧路旅人2》:向光而生 《歧路旅人2》:向光而生 衛青柏 | 2023-05-02
  • vivo X90S曝光:处理器更新为天玑9200+ 安卓最强芯 vivo X90S曝光:处理器更新为天玑9200+ 安卓最强芯 袁曼雁 | 2023-05-05
  • “懒癌”发病率上升,定期体检别忽视 “懒癌”发病率上升,定期体检别忽视 幸聽楓 | 2023-05-02
  • 曹操墓,里面都有啥? 曹操墓,里面都有啥? 衛青柏 | 2023-05-02
  • 宋慧乔获百想视后 韩素希发图手动加爱心表情庆祝 宋慧乔获百想视后 韩素希发图手动加爱心表情庆祝 賁芳蕤 | 2023-05-02
  • 十年了,他们终于要HE! 十年了,他们终于要HE! 惠惠君 | 2023-05-07
  • 中央部署经济工作,释放5大信号 中央部署经济工作,释放5大信号 郜萌運 | 2023-05-02
  • 高德上线手机弯道会车预警功能 高德上线手机弯道会车预警功能 習又夏 | 2023-05-02
  • 陈自瑶抱病为爱女做蛋糕庆生,王浩信点赞没露面 陈自瑶抱病为爱女做蛋糕庆生,王浩信点赞没露面 賁芳蕤 | 2023-05-02
  • 等比例长大的童星,李兰迪算一个 等比例长大的童星,李兰迪算一个 郟君昊 | 2023-05-02
  • 《云襄传》终于抬上来啦,男O女A让人好上头! 《云襄传》终于抬上来啦,男O女A让人好上头! 集玲琳 | 2023-05-02
  • 高端国产车:军车血统,目前电动车越野的“天花板”? 高端国产车:军车血统,目前电动车越野的“天花板”? 謝飛揚 | 2023-05-02
  • 这些被抓来做实验的流浪狗,最终拯救了无数糖尿病人 这些被抓来做实验的流浪狗,最终拯救了无数糖尿病人 集玲琳 | 2023-05-02
  • 21家A股游戏公司2022年收入651亿 今年“游戏+AI”能否逆风翻盘? 21家A股游戏公司2022年收入651亿 今年“游戏+AI”能否逆风翻盘? 衛青柏 | 2023-05-04
  • 与周立波夫妇闹纠纷成老赖,唐爽被司法拘留15日 与周立波夫妇闹纠纷成老赖,唐爽被司法拘留15日 寸飛蘭 | 2023-05-05
  • 普京签署总统令,批准对俄刑法典相关法条的修正案 普京签署总统令,批准对俄刑法典相关法条的修正案 集玲琳 | 2023-05-02
  • 信用风险释放趋缓,结构性风险需重点关注 ——2023年一季度债市信用风险回顾与下阶段展望 信用风险释放趋缓,结构性风险需重点关注 ——2023年一季度债市信用风险回顾与下阶段展望 袁曼雁 | 2023-05-02
  • 中银证券给予南京银行增持评级 中银证券给予南京银行增持评级 袁曼雁 | 2023-05-03
  • 解除资格!停止一切合作 解除资格!停止一切合作 佼昌翰 | 2023-05-02
  • 3699起 联想小新mini主机上架 13代酷睿标压处理器 3699起 联想小新mini主机上架 13代酷睿标压处理器 習又夏 | 2023-05-05
  • 前董事长被免,天山生物全面进入“中植系”时代?股价曾在一月内暴涨超400% 前董事长被免,天山生物全面进入“中植系”时代?股价曾在一月内暴涨超400% 惠惠君 | 2023-05-02
  • 疯成这样,怎么还能被全网吹捧? 疯成这样,怎么还能被全网吹捧? 郜萌運 | 2023-05-02
  • 狂吼11次“让一下”!交警咆哮开道嘶吼到吐 狂吼11次“让一下”!交警咆哮开道嘶吼到吐 寸飛蘭 | 2023-05-03
  • 摩根大通收购美国第一共和银行 摩根大通收购美国第一共和银行 謝飛揚 | 2023-05-02
  • 台剧赢麻了,又来一部8.9 台剧赢麻了,又来一部8.9 衛青柏 | 2023-05-02
  • 事关农村土地承包和农民权益,《农村土地承包合同管理办法》5月1日起施行 事关农村土地承包和农民权益,《农村土地承包合同管理办法》5月1日起施行 郟君昊 | 2023-05-02
  • 下降45分,上涨35分!34所自划线院校复试分数线涨幅汇总 下降45分,上涨35分!34所自划线院校复试分数线涨幅汇总 袁曼雁 | 2023-05-07
  • "三高"已盯上青少年,做好这件事是关键 "三高"已盯上青少年,做好这件事是关键 習又夏 | 2023-05-05
  • 五一档没一个能打的 五一档没一个能打的 集玲琳 | 2023-05-05
  • 恐怖韩剧下神坛,这次胆小可入 恐怖韩剧下神坛,这次胆小可入 袁曼雁 | 2023-05-05
  • 这剧是不是用ChatGPT写的呀? 这剧是不是用ChatGPT写的呀? 惠惠君 | 2023-05-02
  • 200户连夜疏散,原因让人愤怒!“损失超一亿”,官方通报 200户连夜疏散,原因让人愤怒!“损失超一亿”,官方通报 袁曼雁 | 2023-05-03
  • 性骚扰惯犯,滚出娱乐圈 性骚扰惯犯,滚出娱乐圈 謝飛揚 | 2023-05-05
  • 48岁何炅自曝已老花眼,黄磊睡前认老,《向往的生活》证实将停办 48岁何炅自曝已老花眼,黄磊睡前认老,《向往的生活》证实将停办 佼昌翰 | 2023-05-02
  • 一个《长月烬明》倒了,《狐妖》《长相思》《与凤行》…在路上了 一个《长月烬明》倒了,《狐妖》《长相思》《与凤行》…在路上了 惠惠君 | 2023-05-02
  • 当年轻人开始不随份子钱 当年轻人开始不随份子钱 袁曼雁 | 2023-05-02
  • 张天爱假期晒“酷”存照 卷发披肩穿黑色吊带裙大秀好身材 张天爱假期晒“酷”存照 卷发披肩穿黑色吊带裙大秀好身材 嬴覓晴 | 2023-05-02
  • 毕滢用8年时间成功逼宫?曾被传已婚生子的她,不容小觑 毕滢用8年时间成功逼宫?曾被传已婚生子的她,不容小觑 幸聽楓 | 2023-05-03
  • 宋慧乔获视后首次晒照,拿奖杯笑容温柔 宋慧乔获视后首次晒照,拿奖杯笑容温柔 郜萌運 | 2023-05-02

©2022 大酷樂 版權所有

隱私政策 | 服務條款 | 聯繫我們