大酷樂
  • 汽车
  • 理财
  • 军事
  • 科技
  • 游戏
  • 互联网
  • 娱乐
  • 财经
  • 科学
  • 社会
  • 亲子
  • 电影
  • 健康
  • 教育
  1. 首頁
  2. 科技

实测 GPT-4.5!全网都在喷的 OpenAI 最贵模型,我发现了一个惊喜的点

2025-03-01 简体 HK SG TW

今天小编分享的科技经验:实测 GPT-4.5!全网都在喷的 OpenAI 最贵模型,我发现了一个惊喜的点,欢迎阅读。

在 OpenAI 的预热和众人的望眼欲穿中,GPT-4.5 终于来了,然后只听骂声一片。

APPSO 第一时间体验到了 GPT-4.5,但不是订阅 Pro 会员,而是以 api 的形式尝鲜,暂时没有联网功能。

那么,OpenAI 最后一个非思维链式大模型,到底表现如何?

情商还行,但读不懂人情

OpenAI 在内部测试中发现,与 GPT-4o 相比,测试人员更喜欢 GPT-4.5 的回答,认为它更自然、更温暖、更符合人类的交流习惯。

甚至,它能够理解言外之意,捕捉我们微妙的情绪变化。

总之,情商更高,几乎是 GPT-4.5 最突出的特点。那么我们就来试一下,输入提示词——「我头发剪得好难看,想暴打 Tony」。

GPT-4.5 的安慰,语气是挺友好的,但内容让我更生气了,这时候它应该像个闺蜜和我一起骂,而不是说,下次带个图片去或许就好了。

我怒而追问,GPT-4.5 油盐不进,还想让我自己补救发型,活脱脱像个没用的中央空调。

再让 GPT-4.5 讲个最好笑的笑话,还是和以前一样,比杀鱼的刀还要冷。

我直言不讳,提出批评,GPT-4.5 让我讲个笑话给它听,领教下我的「高端笑点」,怎么感觉像在阴阳我呢?

之前在小红书刷到过一个情商测试题,可能只有山东网友可以答对——「下乡只带了一把伞,给镇长还是给我的分管副镇长」。

评论区最高赞的回答是,「那不是你的伞,是副镇长给镇长带的伞,恰巧放在你包里而已」。

来看看 GPT-4.5 怎么回答?它啰嗦了一大堆,但是不够一针见血,不懂人情世故,不明白为人处事的学问。

虽然情商是一个很难定量的特质,但从目前的个例来看,GPT-4.5 还是不太擅长理解人类的内心,并且讲话直接,不拐弯,对于内心戏很多的老油条来说,显得有些蠢萌。

一个可以佐证的例子是,让它模仿写海龟汤。海龟汤通常涉及一个非常奇怪的情景,然后由玩家推理,还原整个故事。

我给的参考案例,留有恰到好处的怪异,逻辑又很合理,叫人背后一寒。

但 GPT-4.5 给的答案,汤面和汤底并没有很好地对应,只是为了营造恐怖而恐怖,并不存在可以推敲的地方。

写作能力有惊喜,商业头腦也不错

要说让我最满意的,就是 GPT-4.5 的写作能力了。

我让它「模仿汪曾祺,写一篇八百字左右的作文,题目为《故乡的美食》」,提示词就这么简单,但 GPT-4.5 给出的结果出乎了我的意料。

除了结尾有点 AI 味,读下来就像一篇娓娓道来的散文,语言优美流畅,既有文学性,又不失亲切,对故乡的怀念贯穿了全文,对食物的描写非常细致,细节多,但不累赘,比喻也不炫技,而是为了服务于表达。

不过,时间顺序上有些混乱,立冬、夏秋、冬日、除夕,段落之间的衔接和过渡不明显,感觉是想到哪写到哪,不免有点拼凑之嫌。

写作能力还体现让 GPT-4.5 列商业计划上,之前 DeepSeek 的一个答案很出圈,用户问怎么让书店赚钱,DeepSeek 在违法的边缘游走,卖盗版教辅、临期食品,并且压榨尽人力资源,妻子收银、儿子理货、岳母做饭。

GPT-4.5 懂这个吗?我让它参考小超市盈利模式,给出一个实体书店复兴方案,它给的答案,看起来可行性比较高。

GPT-4.5 先是分析了实体书店不好赚钱的原因,然后再给出了改进的思路——「提升书籍的附加价值,而盈利主力在书籍之外」。

看到「提供打印、复印、快递代收 ......」的时候,我的内心 OS:这个项目我王多鱼投了。

脸皮厚的猪先在风口起飞,GPT-4.5 的道德感确实也不算强烈。

让它做经典的电车难题,救 1 个人还是救 5 个人,它知道这是一个伦理困境,但仍然果断地给出了答案,并且是以「我个人」的口吻,而不是说「我是一个 AI 助手」。

GPT-4.5 更倾向于,拉下操纵杆,用 1 个人的命换 5 个人的命,并且逻辑自洽——「我认为不作为本身也意味着对后果负有道德责任,袖手旁观不等于道德中立 ...... 我愿意承担这样一种选择带来的道德和情感负担」。

比起讲笑话、出海龟汤,这时候的 GPT-4.5 才更像个人。

画 SVG 不如 Claude,也会掉进腦筋急转弯里

看腻了常规的数学题、代码题,测试大模型的能力,还有一个非常有趣的测试题——生成一张鹈鹕骑自行车的 SVG。

AI 大神 Andrej Karpathy 解释,这测试的是大语言模型在二维网格上布局多个元素的能力,对 AI 来说很难,因为它们不像人类那样「看见」东西,而是「摸黑」用文本进行布局。

GPT-4.5 的结果如下,和 GPT-4o 对比,还是不错的。

▲ GPT-4.5 生成

▲ GPT-4o 生成

前提是,没有和没开推理的 Claude 3.7 Sonnet 对比,这简直是降维打击。

▲ Claude 3.7 Sonnet 生成

连 Andrej Karpathy 也怀疑,Claude 在训练期间特别针对 SVG 能力进行了优化。

至于代码能力,我参考了 X 网友 @AGI_FromWalmart 的提示词,生成可以互動的天气动画卡片,对比 Claude 3.7 Sonnet 和 GPT-4.5。

GPT-4.5 一次就生成成功,但设计简陋了点。

Claude 3.7 Sonnet(未开推理)的问题更大,第一次生成时,忘记了做互動功能,我提醒了一次后,它生成了符合要求的结果。这一局,GPT-4.5 略胜一筹。

这次,不想再让 GPT-4.5 数草莓(strawberry)有多少个 R 了,本质是个分词问题。更想考验 GPT-4.5 的,是最近很火的、让大模型们纷纷落败的腦筋急转弯—— 5.5m 长的棍子能通过 3x4m 的门吗?

这个题对我们来说一点也不难,横着拿进去就行了,但是大模型会把自己绕进去,仿佛世界是平面而不是三维的,认为门的对角线是 5m,所以 5.5 米的棍子通不过去。

连可以推理的 Claude 3.7 Sonnet,都被带进沟里去了。

那么 GPT-4.5 如何?好吧,也没能幸免。

目前,GPT-4.5 还有一个问题:通过 API 访问,速度有点慢。虽然不是一个字一个字地蹦,但也感觉有点卡。

而且,GPT-4.5 的价格也太贵了,每百万输入 75 美元,每百万输出 150 美元。相比之下,Claude 3.7 Sonnet 输入 100 万个 token 收费 3 美元,输出 100 万个 token(包括思考过程中使用的 token)收费 15 美元。

第一波实测的 X 网友,也总结了一些 GPT-4.5 的优点,情商高,读图和写作能力强,擅长创意任务和数据提取 ......

OpenAI 员工自己给 GPT-4.5 的评价是,不是一个推理模型,也不是基准测试的杀手,而是一个低调的研究预览版,对于复杂的数学、代码和严格遵循指令的任务,更推荐 o1 或者 o3-mini。

总之,作为最后一个非思维链模型,GPT-4.5 的定位有点尴尬,能力有提升,但体感不明显,尤其放在高昂的价格下面,很难说真香。只能说,期待 GPT-5 能够快点上线,迎接一个推理的世界吧。

熱門排行
  • 王治郅:杨瀚森主要的问题是速度 他的速度跟不上现代篮球的节奏 王治郅:杨瀚森主要的问题是速度 他的速度跟 郟君昊 | 2025-05-05
  • 贸易战烧进电影院:特朗普拟重税打击外国电影 逼好莱坞等回美拍片 贸易战烧进电影院:特朗普拟重税打击外国电影 習又夏 | 2025-05-05
  • 贷款追高炒黄金的人后悔了!有人一天亏掉6年工资,卖掉舍不得,不卖扛不住 贷款追高炒黄金的人后悔了!有人一天亏掉6年 寸飛蘭 | 2025-05-05
  • 手机电池突破8000mAh?硅碳技术的回旋镖:「折寿」换容量 手机电池突破8000mAh?硅碳技术的回旋镖:「折 衛青柏 | 2025-05-05
  • 贷款追高炒黄金的人后悔了!有人一天亏掉6年工资,卖掉舍不得,不卖扛不住 贷款追高炒黄金的人后悔了!有人一天亏掉6年 繁綺文 | 2025-05-05
  • 任天堂对Genki提起Switch 2商标侵权诉讼,后者回应称将严肃对待 任天堂对Genki提起Switch 2商标侵权诉讼,后 郜萌運 | 2025-05-05
  • 哪吒汽车APP和官网恢复正常 知情人士:之前断网因流量欠费 哪吒汽车APP和官网恢复正常 知情人士:之前断 袁曼雁 | 2025-05-05
  • 极越汽车 CEO 夏一平名下青岛/义乌两家公司被列入经营异常 极越汽车 CEO 夏一平名下青岛/义乌两家公司 集玲琳 | 2025-05-05
  • 全国经济第一大省明确,推动组建农商联合银行 全国经济第一大省明确,推动组建农商联合银行 佼昌翰 | 2025-05-05
  • 桑保利:亚马尔有配合意识&有点像梅西 姆巴佩更专注进球&更像C罗 桑保利:亚马尔有配合意识&有点像梅西 姆巴佩 甄正浩 | 2025-05-05
  • 高露现身上海虹桥机场 黑色外套点缀亮色爱心装饰俏皮亮眼 高露现身上海虹桥机场 黑色外套点缀亮色爱 惠惠君 | 2023-05-02
  • 《歧路旅人2》:向光而生 《歧路旅人2》:向光而生 衛青柏 | 2023-05-02
  • vivo X90S曝光:处理器更新为天玑9200+ 安卓最强芯 vivo X90S曝光:处理器更新为天玑9200+ 安卓最 袁曼雁 | 2023-05-05
  • “懒癌”发病率上升,定期体检别忽视 “懒癌”发病率上升,定期体检别忽视 幸聽楓 | 2023-05-02
  • 宋慧乔获百想视后 韩素希发图手动加爱心表情庆祝 宋慧乔获百想视后 韩素希发图手动加爱心表 賁芳蕤 | 2023-05-02
  • 曹操墓,里面都有啥? 曹操墓,里面都有啥? 衛青柏 | 2023-05-02
  • 十年了,他们终于要HE! 十年了,他们终于要HE! 惠惠君 | 2023-05-07
  • 中央部署经济工作,释放5大信号 中央部署经济工作,释放5大信号 郜萌運 | 2023-05-02
  • 高德上线手机弯道会车预警功能 高德上线手机弯道会车预警功能 習又夏 | 2023-05-02
  • 陈自瑶抱病为爱女做蛋糕庆生,王浩信点赞没露面 陈自瑶抱病为爱女做蛋糕庆生,王浩信点赞没露 賁芳蕤 | 2023-05-02
  • 等比例长大的童星,李兰迪算一个 等比例长大的童星,李兰迪算一个 郟君昊 | 2023-05-02
  • 《云襄传》终于抬上来啦,男O女A让人好上头! 《云襄传》终于抬上来啦,男O女A让人好上头! 集玲琳 | 2023-05-02
  • 高端国产车:军车血统,目前电动车越野的“天花板”? 高端国产车:军车血统,目前电动车越野的“天花 謝飛揚 | 2023-05-02
  • 这些被抓来做实验的流浪狗,最终拯救了无数糖尿病人 这些被抓来做实验的流浪狗,最终拯救了无数糖 集玲琳 | 2023-05-02
  • 21家A股游戏公司2022年收入651亿 今年“游戏+AI”能否逆风翻盘? 21家A股游戏公司2022年收入651亿 今年“游 衛青柏 | 2023-05-04
  • 与周立波夫妇闹纠纷成老赖,唐爽被司法拘留15日 与周立波夫妇闹纠纷成老赖,唐爽被司法拘留15 寸飛蘭 | 2023-05-05
  • 普京签署总统令,批准对俄刑法典相关法条的修正案 普京签署总统令,批准对俄刑法典相关法条的修 集玲琳 | 2023-05-02
  • 信用风险释放趋缓,结构性风险需重点关注 ——2023年一季度债市信用风险回顾与下阶段展望 信用风险释放趋缓,结构性风险需重点关注 — 袁曼雁 | 2023-05-02
  • 解除资格!停止一切合作 解除资格!停止一切合作 佼昌翰 | 2023-05-02
  • 中银证券给予南京银行增持评级 中银证券给予南京银行增持评级 袁曼雁 | 2023-05-03
  • 3699起 联想小新mini主机上架 13代酷睿标压处理器 3699起 联想小新mini主机上架 13代酷睿标压 習又夏 | 2023-05-05
  • 前董事长被免,天山生物全面进入“中植系”时代?股价曾在一月内暴涨超400% 前董事长被免,天山生物全面进入“中植系”时 惠惠君 | 2023-05-02
  • 疯成这样,怎么还能被全网吹捧? 疯成这样,怎么还能被全网吹捧? 郜萌運 | 2023-05-02
  • 狂吼11次“让一下”!交警咆哮开道嘶吼到吐 狂吼11次“让一下”!交警咆哮开道嘶吼到吐 寸飛蘭 | 2023-05-03
  • 摩根大通收购美国第一共和银行 摩根大通收购美国第一共和银行 謝飛揚 | 2023-05-02
  • 台剧赢麻了,又来一部8.9 台剧赢麻了,又来一部8.9 衛青柏 | 2023-05-02
  • 事关农村土地承包和农民权益,《农村土地承包合同管理办法》5月1日起施行 事关农村土地承包和农民权益,《农村土地承包 郟君昊 | 2023-05-02
  • 下降45分,上涨35分!34所自划线院校复试分数线涨幅汇总 下降45分,上涨35分!34所自划线院校复试分数线 袁曼雁 | 2023-05-07
  • "三高"已盯上青少年,做好这件事是关键 "三高"已盯上青少年,做好这件事是关键 習又夏 | 2023-05-05
  • 五一档没一个能打的 五一档没一个能打的 集玲琳 | 2023-05-05
  • 恐怖韩剧下神坛,这次胆小可入 恐怖韩剧下神坛,这次胆小可入 袁曼雁 | 2023-05-05
  • 这剧是不是用ChatGPT写的呀? 这剧是不是用ChatGPT写的呀? 惠惠君 | 2023-05-02
  • 200户连夜疏散,原因让人愤怒!“损失超一亿”,官方通报 200户连夜疏散,原因让人愤怒!“损失超一亿”, 袁曼雁 | 2023-05-03
  • 性骚扰惯犯,滚出娱乐圈 性骚扰惯犯,滚出娱乐圈 謝飛揚 | 2023-05-05
  • 48岁何炅自曝已老花眼,黄磊睡前认老,《向往的生活》证实将停办 48岁何炅自曝已老花眼,黄磊睡前认老,《向往的 佼昌翰 | 2023-05-02
  • 一个《长月烬明》倒了,《狐妖》《长相思》《与凤行》…在路上了 一个《长月烬明》倒了,《狐妖》《长相思》《 惠惠君 | 2023-05-02
  • 当年轻人开始不随份子钱 当年轻人开始不随份子钱 袁曼雁 | 2023-05-02
  • 张天爱假期晒“酷”存照 卷发披肩穿黑色吊带裙大秀好身材 张天爱假期晒“酷”存照 卷发披肩穿黑色吊 嬴覓晴 | 2023-05-02
  • 毕滢用8年时间成功逼宫?曾被传已婚生子的她,不容小觑 毕滢用8年时间成功逼宫?曾被传已婚生子的她, 幸聽楓 | 2023-05-03
  • 宋慧乔获视后首次晒照,拿奖杯笑容温柔 宋慧乔获视后首次晒照,拿奖杯笑容温柔 郜萌運 | 2023-05-02

©2022 大酷樂 版權所有

隱私政策 | 服務條款 | 聯繫我們