苹果新作:内化视觉思考,推理提速 5 倍
苹果新作:内化视觉思考,推理提速 5 倍苹果研究团队提出 Internalized Visual Thinking(IVT)后训练框架,通过在训练阶段联合学习文本答案与未来帧隐空间表征、在推理阶段完全移除未来视觉预测过程,使模型在主动视频推理任务上相比 Visual CoT 获得超过 5 倍的推理加速,且在六项评测设置中均优于 Answer-Only SFT。
搜索
苹果研究团队提出 Internalized Visual Thinking(IVT)后训练框架,通过在训练阶段联合学习文本答案与未来帧隐空间表征、在推理阶段完全移除未来视觉预测过程,使模型在主动视频推理任务上相比 Visual CoT 获得超过 5 倍的推理加速,且在六项评测设置中均优于 Answer-Only SFT。
据《The Information》报道,OpenAI 最强新模型 Astra 被曝采用「循环深度」(recurrent depth)技术,使模型在输出 Token 前完成多轮潜在空间计算并显著提升网络安全能力,但这一「少说多想」的推理方式因思维链可能被压缩到难以读取的内部状态而引发 AI 安全专家对监管失效的担忧。
微软与UIUC合作研究StudentSim框架,基于真实学生数据训练个性化学生模拟器,具备behavioral fidelity和guidance responsiveness两项能力,在国际象棋等三个领域验证其优于现有基线,并可作为AI教师强化学习的高通量奖励信号。
就在刚刚,GPT-6打破孪生素数猜想新纪录。
刚刚,AI又双叒叕解决了一个数学难题。
2026年9月3日,嬴彻科技宣布其卡车自动驾驶商业运营里程突破10亿公里,形成行业最大规模的真实运营数据资产。
让GPU学会给三维世界“排队”。
当我们惊叹于大语言模型能写诗、会编程时,科学家们正面临一个更棘手的问题:如何让AI像真正的科研工作者一样,去解决那些需要数月甚至数年持续思考、且充满未知的科学难题?
时下,Linux 内核正在经历一场有些特殊的“漏洞大爆发”。
OpenAI正式发布GPT-6 Astra,宣称其为"全球最智能且最对齐的模型",在电脑操作(OSWorld完成率72.6%)、ARC-AGI-3(99.9分)、审美判断力、主动性及网络安全(首个达Critical等级)等方面全面升级,Greg Brockman在媒体闭门会上宣布"欢迎来到AGI时代"。