铭鸿体育资讯网

【AI 快把「智力测试」刷穿了,公司却开始给模型上锁】 #AGI时代真的来了吗# 今年 3 月,ARC-AGI-3 放出了一批没有说明书的小游戏,规则全靠自己摸索。当时人类能轻松拿满分,最强 AI 却只有 0.51%。 结果不到半年,GPT-6 Astra 接入上下文管理工具后,硬生生把成绩刷到了 99.9%。 虽然出题方赶紧灭 ​

【AI 快把「智力测试」刷穿了,公司却开始给模型上锁】 AGI时代真的来了吗

今年 3 月,ARC-AGI-3 放出了一批没有说明书的小游戏,规则全靠自己摸索。当时人类能轻松拿满分,最强 AI 却只有 0.51%。

结果不到半年,GPT-6 Astra 接入上下文管理工具后,硬生生把成绩刷到了 99.9%。

虽然出题方赶紧灭火,强调游戏规则固定,刷满也不等于实现 AGI,但同期的另外两条动态,也不由得给大伙儿一种「未来已来」的感觉。

一边是 Anthropic 发布了 Claude Fable 5.1,却把网络安全和生物研究能力更强悍的 Mythos 5.1 直接「雪藏」,只对少数审核机构开放;另一边,Figure 一口气签下 10 万块 GPU,准备从明年下半年开始给下一代通用机器人「练脑子」。

做题的快拿满分了,偏科的强到要关禁闭,还有个正准备长出真实的身体。当 AI 的进化同时在代码和物理世界狂飙,它的边界确实越来越难画了。

🎤 你觉得现在的 AI 算是真聪明,还是纯靠算力「大力出奇迹」?

人工智能大模型