世界模型应如何评估?南京大学团队发布「世界模型」评估立场论文
世界模型应如何评估?南京大学团队发布「世界模型」评估立场论文近期,围绕「世界模型」的讨论持续升温。机器人、自动驾驶、视频生成、具身智能等多个方向都在频繁使用这一概念,相关系统不断出现,演示形式日益丰富,评价指标也越来越多。伴随这一趋势,一个基础问题变得格外重要:当一个模型被称为「世界模型」时,人们究竟在评价什么?
搜索
近期,围绕「世界模型」的讨论持续升温。机器人、自动驾驶、视频生成、具身智能等多个方向都在频繁使用这一概念,相关系统不断出现,演示形式日益丰富,评价指标也越来越多。伴随这一趋势,一个基础问题变得格外重要:当一个模型被称为「世界模型」时,人们究竟在评价什么?
在过去二三十年的互联网发展中,个性化推荐几乎一直是平台的核心能力之一。打开视频 app,平台决定你接下来会刷到什么视频;打开购物软件,平台预测你可能会购买什么商品;打开短视频 app,平台根据你的浏览、点赞、停留和互动,不断优化信息流。某种意义上,现代互联网的用户体验本身就是由推荐系统塑造的。
人类可以在一生中持续学习新知识,而不会轻易遗忘已有技能。然而对 AI 模型而言,这恰恰是一道极具挑战性的难题:每当模型学习新任务时,参数更新往往会覆盖历史知识,产生经典的 “灾难性遗忘” 难题。持续学习(Continual Learning)正是为突破这一瓶颈而生的研究方向。
最新做社交的互联网公司还不少,哈啰也下场了。
相比起听商业大佬谈投资法则,女孩们更想学会如何斩断情丝、在婚恋中获益。有人把曲曲和谢胜子上百小时的直播切片整理后,做成了可对话的Skill。很快,免费版在外网上流传。为了能和AI曲曲对话,一群此前连GitHub怎么拼都不知道的女性,开始学着搭梯子、注册Claude账号。
大家好,我是冷逸。 前段时间,我设计了一家民宿「冷同学的院子」,视觉还算有点意思,不少朋友跑来问设计上的事。也有人问我:要是自己网上开店,有没有那种“够简单、说一句就能出设计”的电商工具?
近期,美国俄勒冈州立大学研发出一种新型成像传感器,不仅可在探测光线的同时进行图像存储(近期光照信息),还能实现信息的按需“遗忘”。
几个月前,马斯克还骂Anthropic「邪恶」,断言它「不可能赢」,如今突然改口称它是「当前AI最强」。 手握22万块GPU的他,为何没有趁机断供对手?
最近我在使用的一款浏览器工具叫做 Ego Lite。这款浏览器,是给 Agent 准备的。比如我在 Agent 工具(Codex)里说,在此期间,Ego Lite 的人机交互界面不受任何影响,Agent 也不会打开新的浏览器界面——比如 Codex 操作 Chrome 那样,在你的浏览器里点来点去翻找内容——Agent 只是默默干活,然后给你最终结果。
7 月 8 日,韩国知名开发者 remy_notes 在 Threads 上晒出两张 Anthropic 发票截图:第一张 166.9 万美元(约 1130 万元人民币),第二张 1662 万美元(约 1.1 亿元人民币)。两张发票间隔不到 24 小时,金额翻了近 10 倍。