老黄替OpenAI宣布AGI!出题人当场打脸:换个考场99.9%掉到62.7%
老黄替OpenAI宣布AGI!出题人当场打脸:换个考场99.9%掉到62.7%OpenAI发布GPT-6 Astra并称在ARC-AGI-3基准上以99.9%分数"饱和"测试,但出题机构ARC Prize指出标准环境下得分仅62.7%并拒绝承认AGI,黄仁勋随即在X上宣布"AGI已到来",而OpenAI总裁Brockman仅以"个人判断"定性,折射出AGI的定义权与宣布权背后掺杂算力销售和商业利益博弈的混乱局面。
搜索
OpenAI发布GPT-6 Astra并称在ARC-AGI-3基准上以99.9%分数"饱和"测试,但出题机构ARC Prize指出标准环境下得分仅62.7%并拒绝承认AGI,黄仁勋随即在X上宣布"AGI已到来",而OpenAI总裁Brockman仅以"个人判断"定性,折射出AGI的定义权与宣布权背后掺杂算力销售和商业利益博弈的混乱局面。
第一篇AI4AI综述论文将long horizon智能体、AI4AI与recursive self-improvement纳入同一研究地图,指出AI能在明确目标与评价规则下承担部分研发工作,但单项能力提升无法证明完整流程可靠,持续自我改进仍面临组合鸿沟等验证挑战。
9月7日科大讯飞发布星火X2.5模型,基于万卡国产910B集群完成预训练和后训练,并使其具备在真实NPU环境中自主优化算子的能力,通过DSA算子案例经约1600次工具调用实现3.5倍加速,形成AI反哺国产算力的技术闭环。
AI科技评论独家获悉,地瓜机器人具身智能负责人何泳澔已离职并加入具身赛道新公司,预计近期官宣,何泳澔为中科院自动化所模式识别与人工智能博士,其研究重心偏向工业场景落地。
Anthropic发布2026年9月威胁情报报告,指出AI滥用已从辅助工具升级为可自主运行的行动系统,覆盖非法模型蒸馏、零日漏洞自动化挖掘、多Agent集群滥用等七大风险领域。
Astra 太好用,连 OpenAI 也扛不住了。
GPT-6 Astra也是一个集美模型。
到 2030 年,如果 AI 已经能够自主完成大量工作,美国经济会发生什么?AI 会让我们变得更富有?还是带来更多失业?
OpenAI因GPT-6 Astra算力需求激增,于9月10日正式暂停200美元/月ChatGPT Pro档新订阅与升级,其他套餐及现有用户不受影响。
中国AGI两条上山路径:一条让机器理解、运用语言,另一条让机器认知、推演并改造世界,二者终会交汇。