在多项高难度Benchmark超越GPT-6 Astra,RSIAgent让开源模型自主探索新环境
在多项高难度Benchmark超越GPT-6 Astra,RSIAgent让开源模型自主探索新环境大模型过去几年的能力跃迁,几乎都围绕一个词:Scaling。
搜索
大模型过去几年的能力跃迁,几乎都围绕一个词:Scaling。
网友将HHMI Janelia和Google Research发布的果蝇大脑神经图谱MaleCNS接入AI,让虚拟苍蝇玩《超级马里奥64》《反恐精英2》《艾尔登法环》等游戏、在Coinbase炒币、识别日文平假名、参加虚拟MMA格斗,甚至操控多足机器人。
让模型自己生成训练数据、自己改写提示词、自己修复代码,这条路线被称为: 递归自我改进(Recursive Self-Improvement,RSI)。
最新消息,特朗普对马斯克、Dario Amodei和奥特曼的「减速避险」计划大发雷霆!
前几天,著名外宾AI应用 Genspark 干了一件以前不太像它会干的事。
有了AI,现在的学生,真的是不得了—— 仅仅耗时4天时间,就做出了一个AI短片,然后直接斩获一等奖,拿下30000元!
当个性化Agentic RL遇上现实用户平台场景时,一直存在一个常见难点:面对同样的query,不同用户往往偏好不同的规划策略、工具调用和最终表达。
过去一年,具身智能的技术迭代明显加快。VLA、世界模型持续演进,强化学习重新成为机器人学习的重要技术路径,Sim2Real加速从仿真走向真机,全身控制能力也在快速突破。
如今的 AI 已经能顺畅地帮你写代码、跑实验、做评估。算法工程师的每一天,几乎变成了:让 LLM 整理昨天的实验结果,让 LLM 实现新想法,让 LLM 监控实验运行…… 似乎只需把需求告诉 AI,它就能完成大部分算法工作。
Anthropic CEO Dario Amodei发表长文呼吁控制前沿AI能力提升节奏并引入嵌入式第三方安全评估机制,OpenAI CEO Altman随即表态支持,并以AI安全为由确认OpenAI今年不会进行IPO。