马斯克下场助威:Grok凭常识快过ChatGPT工具计算
创始人
2025-09-08 16:43:44

科技从业者路易斯,今日分享了大语言模型(LLM)在判断 “大偶数是否为质数” 时的有趣差异。此条在社交媒体上的小实验被埃隆·马斯克光速转载,似乎是实验结果显示Grok比GPT略胜一筹。

实验内容为:当被问及“748218957198847892 是否为质数”这类问题时,ChatGPT选择调用NumPy工具包开展数值测试以验证结果。

而X平台(原Twitter)旗下的Grok,则直接利用“除2以外,所有偶数都不是质数”的数学常识,瞬间判定该数并非质数。

这一对比凸显出不同LLM在逻辑推理与工具使用上的设计侧重:ChatGPT更倾向于借助外部工具开展“数值化验证”,以确保结论的计算严谨性;Grok则展现出对基础数学逻辑的 “直觉式调用”,能快速锚定问题核心特征并得出结论。

这种差异也引发业内讨论:大模型的“常识储备深度”与“工具协作能力”该如何平衡——前者考验模型对知识的内化效率,后者则关乎其与外部系统的协同智能。(转载自AI普瑞斯)

相关内容

热门资讯

服贸新观察|首设出海服务展区 ...   新华社北京9月13日电(记者吉宁 张骁)金秋9月,首钢园工业遗存的硬朗线条,与服贸会的璀璨灯光交...
本周末10余家公司披露回购增持... 9月13日晚间,三一重工、天安新材、永茂泰等多家主板公司同步披露股份回购进展,以真金白银的行动践行对...
支付宝惊现假App!1.8元能... 欢迎关注我的好朋友:杠杆游戏!撰文|蜜妹这是@闺蜜财经的第1819篇原创图片来源|AI自动生成支付宝...
两只大牛股,紧急发声:不属实!... 5天3板超声电子:“超声电子高频板通过英伟达认证”情况不属实,目前无产品供货给英伟达9月13日晚间,...
英企悔不当初!当初叫嚣“绝不与... 航空发动机是飞机的“心脏”,全世界能完全自主研制航空发动机的国家,掰着一只手都数得过来。中国过去在这...