AI资讯新闻榜单内容搜索-RL

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: RL
答对了却没看图?EASE给多模态RLVR装上「视线校正器」

答对了却没看图?EASE给多模态RLVR装上「视线校正器」

答对了却没看图?EASE给多模态RLVR装上「视线校正器」

强化学习与可验证奖励(RLVR)已成为提升视觉语言模型(VLM)推理能力的标配手段。但一个隐蔽的问题始终存在:最终答案的奖励信号,只告诉模型「答对了没有」,却从不告诉它「答案应该从图像的哪个区域得出」。答对,可能是因为真的看懂了图,也可能只是语言先验的捷径、数据集的偏差,甚至是一次幸运的瞎猜。

来自主题: AI技术研报
7028 点击    2026-09-03 14:17
李飞飞发布世界模型这天,Visko也让AI视频开起了直播

李飞飞发布世界模型这天,Visko也让AI视频开起了直播

李飞飞发布世界模型这天,Visko也让AI视频开起了直播

李飞飞旗下World Labs发布世界模型Atlas的同一天,Qing Yin创办的Visko推出世界模型Orbis并完成1000万美元Pre-seed融资,主打画面可持续运行并接受实时指令的Live Model。

来自主题: AI资讯
9196 点击    2026-09-02 16:28
李飞飞发布:全球首个多模态世界模型

李飞飞发布:全球首个多模态世界模型

李飞飞发布:全球首个多模态世界模型

「全球首个」多模态世界模型,来了!

来自主题: AI技术研报
7623 点击    2026-09-02 10:07
3D 生成进入场景级时代,影眸 Hyper3D 发布世界生成模型 WorldGen

3D 生成进入场景级时代,影眸 Hyper3D 发布世界生成模型 WorldGen

3D 生成进入场景级时代,影眸 Hyper3D 发布世界生成模型 WorldGen

影眸Hyper3D发布世界生成模型WorldGen,用户上传一张场景图片即可在两三分钟内生成由多个独立可交互物体组成的3D场景,物体具备质量、摩擦系数等物理属性,可直接接入Blender、Unity、Unreal Engine等主流工具及机器人仿真环境,标志着3D生成进入场景级时代。

来自主题: AI资讯
9640 点击    2026-09-01 16:38
AI 下半场,不会只剩一个超级模型|对谈 Kevin Ding:Pyromind 创始人/CEO

AI 下半场,不会只剩一个超级模型|对谈 Kevin Ding:Pyromind 创始人/CEO

AI 下半场,不会只剩一个超级模型|对谈 Kevin Ding:Pyromind 创始人/CEO

本周「十字路口」的嘉宾是 Pyromind 创始人 / CEO Kevin Ding。Pyromind 所在的赛道,常被称作 RL as a Service,也就是强化学习即服务、或后训练即服务。公司前不久完成天使轮融资,投资方包括高瓴、百度风投、蓝驰、Atypical 等机构。

来自主题: AI资讯
5929 点击    2026-09-01 10:28
做世界模型的这批研究员,开始让一群AI活成一个社会

做世界模型的这批研究员,开始让一群AI活成一个社会

做世界模型的这批研究员,开始让一群AI活成一个社会

Alaya Lab推出反事实社会模拟产品合成世界Synthetic World,用户可改变故事中的关键事实进入平行时间线,观察AI居民持续互动、建立关系并自主推动剧情演化,目前平台已积累数百个世界、万级居民和近两万条社区动态。

来自主题: AI资讯
9453 点击    2026-08-30 14:13
港科大(广州)联合腾讯AI平台部开源VibeWorlding,3D世界构建迎来Vibe Coding时刻?

港科大(广州)联合腾讯AI平台部开源VibeWorlding,3D世界构建迎来Vibe Coding时刻?

港科大(广州)联合腾讯AI平台部开源VibeWorlding,3D世界构建迎来Vibe Coding时刻?

如果说 Vibe Coding 让「写代码」这件事从「敲键盘」变成了「和 AI 对话」,那么今天要介绍的这项工作,可能正在把同样的故事在 3D 世界构建 领域重演一遍。

来自主题: AI技术研报
9797 点击    2026-08-28 11:02
被开除的Thinking Machines CTO,又离开OpenAI回谷歌了

被开除的Thinking Machines CTO,又离开OpenAI回谷歌了

被开除的Thinking Machines CTO,又离开OpenAI回谷歌了

几个小时前,Barret Zoph 在 𝕏 上发了一条推文,他说自己将加入谷歌 DeepMind,而他的 AI 生涯正是从谷歌 Brain 的 Residency 项目起步的,这次算是重返旧地;他将专注于强化学习(RL)与后训练(Post-Training)方向,更多消息稍后公布;他还补了一句,谷歌拥有在 AI 领域持续成功所需要的全部要素,他很高兴能成为这个使命的一部分。

来自主题: AI资讯
9529 点击    2026-08-27 20:15