伊隆·马斯克(Elon Musk)宣布了“世界上最聪明的AI”,但事实并非如此简单

Follow US

80FansLike
908FollowersFollow
57FollowersFollow

Grok 3 即将发布,但它不会像马斯克希望我们相信的那样令人惊叹。

每天都有大大小小的AI被宣布,每个AI都希望在各个领域超越其他AI。然而,这种情况通常只发生在某些基准测试或编程等更复杂的任务中。Jan认为,这对普通用户来说没什么区别。

尽管如此,埃隆·马斯克还是将他的人工智能公司xAI的新大型语言模型(LLM)Grok 3描述为世界上最聪明的AI。但这一说法的背后是什么?

埃隆·马斯克(Elon Musk)被认为是世界上最富有的人之一,但同时也是最具争议的人之一。他发表过恐同言论,并因反犹太主义而受到指责,因为他曾说犹太裔投资者乔治·索罗斯(George Soros) 憎恨人类,并对索罗斯抱有阴谋论,还讨论了他对言论自由的态度。

自马斯克收购推特(现为X)以来,关于该平台处理仇恨言论、假新闻和政治影响力的投诉日益增多。最近,马斯克还在X上亲自攻击了多位欧洲国家元首,则积极干预德国联邦选举活动。在美国政治中,他被认为是特朗普的顾问,据说在新总统领导下担任新设立的流程优化办公室的职务。在特朗普于2025年1月宣誓就职后,马斯克在一次公开活动中做了一个被广泛认为是纳粹礼的手势。

最近他还多次干涉德国政治。例如,他在《世界报》上发表了一篇备受批评的客座文章,支持德国另类选择党(AfD),或为该党的总理候选人爱丽丝·魏德尔(Alice Weidel)在X上直播提供平台,并在此过程中多次发表不实言论。

Grok 3:内部

Musk和xAI的一些开发人员在X上直播了Grok 3。

根据马斯克的说法,人工智能应该可怕地聪明,聪明到令人恐惧。因此,据说Grok 3比ChatGPT-4o具有更好的逻辑结论、更强的计算能力和更高的适应性。

这意味着该模型计算速度更快,能够更精确地理解复杂关系,并且能够更灵活地应对不同的问题。

根据xAI的说法,Grok 3能够做到以下几点:

  • 据说,这款人工智能是在Colossus超级计算机(100,000个Nvidia H100 GPU)上训练出来的。
  • 据说,训练过程花费了2亿个GPU小时,是Grok 2的十倍。
  • 该模型使用人工生成的数据进行训练。这种合成数据旨在确保数据集的多样性和可控性,并减少隐私问题。
  • 开发人员使用了强化学习和强化学习,这是一种机器学习方法,模型根据奖励函数评估并改进其输出。
  • 此外,还应用了强化学习与人类反馈(RLHF):由真人对输出结果进行评估,以完善奖励函数,进一步提高人工智能内容的质量。
  • 语境训练旨在确保人工智能更好地理解并调整答案的语境。
  • LLM应该能够通过分析和比较答案与事实来纠正自己。
  • 深度搜索是一种高级研究和语言功能,将在稍后添加。

大目标:减少幻觉,提高逻辑准确性。

什么是幻觉?LLM中的幻觉是虚假或虚构的信息。这是所有常见聊天机器人的已知弱点,也是您应该始终质疑AI生成的答案的主要原因。

Grok 3 何时上市? 在美国,部分用户已经可以使用 Grok 3。首先面向付费用户(40 美元/月)。然而,具体的时间表尚未确定。

在欧盟和英国,Grok 3 暂时无法使用,因为 xAI 必须进行调整以符合欧盟法规。

Grok 3:世界上最聪明的 AI?

Grok 3 为何比其他 LLM 更胜一筹?根据 xAI 在直播中展示的基准测试,Grok 3 在数学、编程和科学问题等逻辑任务上尤其优于竞争对手。

然而,xAI 没有展示其他领域的基准测试——稍后会有更多内容。

即使Grok 3应该产生更少的幻觉,但这并不意味着这个目标已经实现。OpenAI还依赖于自我校正、合成数据和强化学习与人类反馈(RLHF)。

只有当独立用户能够测试它时,才能知道人工智能究竟有多好。

直播中的可疑言论

马斯克和他的团队的一些言论可能会产生误导或误导。这就是为什么我们要在这里讨论它们:;

终极求真的AI: 马斯克在直播中声称,Grok 3是终极求真的AI,有时会与政治正确相矛盾。很难说他是暗示其他开发者故意美化事实,还是积极寻求以不同的方式呈现事实或背景,抑或纯粹出于政治挑衅。

人工智能每天都在进步: 马斯克声称模型每天都在改进。如果这意味着细微的调整,那也没问题。然而,我们要明确的是,LLM的训练最终在发布前结束——之后只进行细微的调整。

显著的开发时间: 马斯克强调xAI在2023年才开始开发,而其他公司从2019年开始就一直在研究LLM。他没有提到真正的突破不在于开发时间,而在于海量的数据和计算能力。因此,对于财力雄厚的公司来说,快速开发自己的AI模型相对容易。

仅在三个领域进行基准测试:Grok 3在其他领域(如语言任务)的表现如何,目前尚不清楚。这是因为马斯克和他的团队只展示了逻辑任务的基准测试。

因此,世界上最聪明的AI这个称号与其说是可验证的事实,不如说是营销手段。至少马斯克和他的团队没有展示任何突破性的创新来证明这个最高级的称号。

即使目前Grok 3处于领先地位,但OpenAI、谷歌和Anthropic的新模型肯定已经在开发中了。

在2月11日至13日召开的世界政府峰会上,马斯克表示,这可能是其他人工智能超越Grok的最后一次机会。这还有待观察。

Stephan
Stephan
年齡: 25 出身:保加利 亞愛好:遊戲 職業:網上編輯器,學生

RELATED ARTICLES

“这早就该做了”——今后在《使命召唤:战区》中,只需点击一下,就再也不用看到那些花里胡哨的皮肤了

当然,《使命召唤:战区》本身并不完全写实,但许多玩家仍对《堡垒之夜》那种花里胡哨的皮肤感到困扰。现在,这些皮肤可以被禁用了。多人游戏中的皮肤向来是争议话题。有些人只是想让自己的游戏角色看起来更酷,而另一些人则认为这些皮肤既分散注意力又令人烦躁。此外,对于像《堡垒之夜》这样本就色彩斑斓且风格奇特的游戏来说,这些装饰性道具反而比在《使命召唤:战区》这种以军用棕灰色为主色调的游戏中更显协调——尽管两款游戏的写实程度可能相差无几。不过,《使命召唤:战区》的开发团队显然非常清楚这一干扰因素。他们在X平台宣布,随着《现代战争4》第一赛季的开启(即10月23日游戏发售后不久),玩家今后只需点击一下即可在《使命召唤》大逃杀模式中禁用皮肤。许多人欢呼,但也有人不解从帖子中可以清楚地看到,这些奇装异服将如何转换为《现代战争4》的标准干员造型。这样,当你们自己游戏时,无论其他玩家装备了何种外观,你们看到的都会是标准干员形象。按你的方式体验《使命召唤:战区》。从第一赛季开始,新增的“特工皮肤”切换功能可让你在游戏中仅显示《现代战争4》的特工。了解更多:https://t.co/VwXF5mebTw pic.twitter.com/mkkC6M3lar — 《使命召唤》(@CallofDuty) 2026年9月24日对于皮肤爱好者来说,也有好消息。紧接着的公告称,《现代战争3》中的干员、武器、皮肤、蓝图和迷彩在《现代战争4》发布后仍将继续在《战区》中可用。该帖子最初获得了超过1,400条评论和近11,000个点赞。网友们的反响大多是积极的。 许多人简短地表示自己很高兴,并称赞开发者做出了这一决定。但也有人持怀疑态度,或质疑为何对这一改动大惊小怪,而其他备受批评的方面却未被触及——或者质疑为何该功能没有更早实施。《使命召唤》官方账号在中表示,此前这一改动在技术上无法实现。不过,用户补充了背景信息(X平台为避免虚假信息而设的一项功能),并指出过去曾有过类似功能,其中包括一款PlayStation平台独占的皮肤。用户 Utkarsh Dubey 还质疑了游戏中皮肤存在的意义,毕竟反正没人能看到: 如果只有你能看到这些皮肤,那购买它们有什么意义?它们不应该是为了好玩和炫耀的吗?对于用户 LilBilly 来说,CoD 团队在此处纯粹是 听信了少数喧嚣者的意见:我的意思是,不管怎么说,但我不得不强调,除了推特上这小部分玩家之外,根本没有人对此感兴趣。 你们在开发这个功能上投入了多少时间和精力?而这一切仅仅是因为这里一个相对较小的小群体,假装别人使用的皮肤会破坏他们的游戏体验。我们到底在做什么?如果你们想收集玩家反馈,那很好。但请在游戏内进行。为什么未来的皮肤可能会再次成为问题与此同时,对于其他人来说,这项改动在游戏中究竟会产生怎样的视觉效果,目前还不太清楚。在博客文章中,具体描述了这种体验:游戏将不再显示《黑色行动6》等其他《使命召唤》作品中的特工及其皮肤,而是显示《现代战争4》中的角色。这一情况同样适用于对手、队友或小队成员。玩家自己的角色仍会以装备后的形态显示,因此某些情况下也会带有皮肤。该功能默认处于关闭状态。因此,未特别启用该功能的玩家仍将看到所有干员及外观道具。由于文中明确提到了《现代战争4》的干员,因此可以推测所有其他皮肤和角色都会被遮盖,而不仅仅是那些更奇特的。目前尚不清楚游戏将如何决定使用哪款标准皮肤进行遮盖——毕竟,玩家大概率不希望在战斗中面对或与全是重复角色的对手交战。此外,该功能不包括未来将推出的皮肤和干员——也就是所有计划在《现代战争4》中登场的角色。因此,在某些情况下,通过合作推出的更稀有、更独特的造型可能会逐渐回归,而该开关无法将其屏蔽。《使命召唤:现代战争4》直接承接2023年发行的《现代战争3》。从主题上看,这是当前《现代战争》系列的延续,该系列由开发商Infinity Ward于2019年通过重启开启。在这款射击游戏中,朝鲜发动大规模入侵,朝鲜半岛由此爆发战争。与此同时,普莱斯正经历一场非常私人的内心冲突,这最终将他卷入这场大规模的对抗之中。除了带领玩家穿越全球众多场景的单人战役和经典多人模式外,《战区》也将继续获得支持并推出新内容。

《塞尔达传说》:育碧似乎曾开发一款以加农多夫为主角的游戏

在《马里奥+疯兔》取得成功后,该工作室据称曾提交了一个原型方案。但这家日本游戏巨头最终拒绝了这个雄心勃勃的项目。据称育碧曾计划开发一款新的《塞尔达传说》游戏。相关提案据称涵盖了一个全新的世界观,并拥有一个截然不同的主角。据 Insider Gaming 报道,该项目在内部被命名为“Goliath”,这反映了该游戏所寄予的雄心壮志。育碧前开发者吉安·马尔科·赞纳甚至将该项目称为“电子游戏宇宙中的新大爆炸”,因为主角将由一位此前从未出现过的角色担任。与育碧的合作育碧米兰与任天堂有着成功的合作历史。通过《马里奥+疯兔:王国之战》等作品,该工作室已经证明,它拥有必要的信任,能够以尊重且创新的方式呈现任天堂最重要的品牌。加农多夫担任主角:任天堂对这位系列反派的期许不过任天堂最终似乎并不满意这个构想,因为据报道,在早期概念阶段,他们就要求更换这位主角。取而代之的是让加农多夫担纲主角。这本将是他首次在《塞尔达传说》游戏中以可操控主角的身份担任核心角色。然而,该项目最终仅止步于概念阶段。据报道,任天堂曾要求育碧米兰在2023年底前提交原型版本。该开发工作室虽如期交付,但这家日本游戏巨头仍否决了该方案——具体原因尚不明确。继《马里奥+疯兔》之后:任天堂的下一项合作计划告吹这本不会是任天堂与育碧米兰之间的首次合作,因为该开发团队曾负责制作过《马里奥+疯兔》的两部衍生作品。正是前作的成功促使该工作室开始考虑进一步的合作项目,进而催生了这一构想。目前尚无关于这一被搁置构想的更多细节。因此,故事原本将围绕什么展开仍不得而知。

“我们的游戏水平还不够好”——《战争黎明4》的两位开发者尝试在“困难”难度下对抗兽人,结果遭遇了意想不到的挫折

在《战争黎明4》的最新实机演示视频中,Jan Theysen和Elliott Verbiest联手对抗由AI操控的兽人,结果却并不顺利。看来这些开发者这次有点好高骛远了。在《战争黎明4》的一段新实机演示视频中,King Art Games的Jan Theysen和Elliott Verbiest首次没有选择互相对抗,而是以合作模式挑战AI对手.但作为游戏的开发者,他们自然认为自己对游戏了如指掌,因此并没有选择普通难度,而是直接挑战了高难度的AI。毕竟,这种难度是针对那些“对游戏投入更多”的玩家设计的。而创意总监和游戏总监本人,很可能就属于这一类玩家。但这……并没有奏效。短短17分钟内,这两位开发者就被AI控制的兽人直接击败了两次。比赛回顾这些战斗并非普通的多人小规模交火。这里的目标并不局限于获取胜利点数,也不仅仅是把敌人从地图上清除。玩家进行的是所谓的“漩涡”模式对战。在此模式下,地图上会以固定节奏随机生成目标,双方必须将其摧毁或收集。每完成一个目标即可获得胜利点数,直至其中一方获胜。事实上,开发者们也指出,对于这种玩法,兽人确实比他们所使用的太空陆战队更胜一筹。 因为兽人属于“大军”阵营,其生产单位的速度远比行动稍显迟缓的太空陆战队更快、数量更多。尽管如此,两人还是对兽人压倒性的优势感到惊讶。第一回合仅进行了4分钟便告结束。在这回合中,兽人完成的任务目标远多于太空陆战队。在第二回合中,开发者们坚持的时间稍长了一些。不过,他们最终还是不得不认输。这次并非主要因为任务目标,而是由于兽人在军事上拥有如此压倒性的优势,抵抗似乎已毫无意义。这对游戏意味着什么?这段视频当然表明,《战争黎明4》的AI绝非等闲之辈!既然连开发者都苦战不休,它无疑将带来一场真正硬核的挑战。不过,大家也应该清楚,这绝非最终版本。游戏发售日期最近刚从9月推迟到了12月3日——这意味着开发团队仍在持续打磨游戏,显然也在调整游戏平衡性。工作室负责人扬·泰森(Jan Theysen)在视频中还提到:“我得和程序员们好好谈谈了”。当然,这更多是开玩笑的,但游戏难度确实可能会稍作调整。不过,视频中的两人当然也在顺便进行解说。而且,大家不应低估在全程需要逗乐观众的同时进行游戏,有时会有多困难。