AI资讯新闻榜单内容搜索-Al

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Al
当 AI 开始为 AI 造“认知外骨骼”:不训模型,也能让小 AI 能力翻倍?AI4AI 正从这里开始

当 AI 开始为 AI 造“认知外骨骼”:不训模型,也能让小 AI 能力翻倍?AI4AI 正从这里开始

当 AI 开始为 AI 造“认知外骨骼”:不训模型,也能让小 AI 能力翻倍?AI4AI 正从这里开始

Salesforce AI与UIUC研究人员提出Strong-to-Weak Scaffolding方法,让强模型(Builder AI)为弱模型GPT-5.4-mini自动设计外部Harness工作框架,无需修改参数即可将其在心智理论任务上的平均准确率从0.488提升至最佳0.912,揭示AI4AI的核心机制是将认知结构而非知识从强模型迁移至弱模型。

来自主题: AI技术研报
8247 点击    2026-08-31 15:26
HOMIE Gen2全新发布!解锁人类经验的Scaling Law

HOMIE Gen2全新发布!解锁人类经验的Scaling Law

HOMIE Gen2全新发布!解锁人类经验的Scaling Law

新加坡Physical AI公司Ropedia正式发布新一代多模态采集系统HOMIE Gen2,以4目全景360°、十余种模态同步采集与开箱即用的高精度训练级数据,将人类经验规模化为机器人可直接学习的训练数据,推动Physical AI的经验规模化落地。

来自主题: AI资讯
10367 点击    2026-08-31 13:56
刚刚,OpenAI发布重磅产品,Codex一秒化身「AI科学家」!

刚刚,OpenAI发布重磅产品,Codex一秒化身「AI科学家」!

刚刚,OpenAI发布重磅产品,Codex一秒化身「AI科学家」!

OpenAI正式发布生命科学AI工作台Rosalind Workbench,基于GPT-Rosalind推理模型集成至Codex,内置分子结构、序列比对、病理切片三个可视化查看器及NGS分析模块,接入Boltz等外部专业插件,目前以研究预览形式向机构开放。

来自主题: AI资讯
10560 点击    2026-08-30 14:14
做世界模型的这批研究员,开始让一群AI活成一个社会

做世界模型的这批研究员,开始让一群AI活成一个社会

做世界模型的这批研究员,开始让一群AI活成一个社会

Alaya Lab推出反事实社会模拟产品合成世界Synthetic World,用户可改变故事中的关键事实进入平行时间线,观察AI居民持续互动、建立关系并自主推动剧情演化,目前平台已积累数百个世界、万级居民和近两万条社区动态。

来自主题: AI资讯
9455 点击    2026-08-30 14:13
刚刚,OpenAI拉上Anthropic和100多家机构联名警告:行动时间不多了

刚刚,OpenAI拉上Anthropic和100多家机构联名警告:行动时间不多了

刚刚,OpenAI拉上Anthropic和100多家机构联名警告:行动时间不多了

OpenAI联合Anthropic、AWS、Google、Microsoft等超过100家科技、安全及金融机构发布网络防御公开信,警告未来数月AI驱动的网络攻击将更加复杂,可能严重威胁医院、水处理设施及互联网基础设施,Sam Altman发文强调这是AI网络防御的关键时刻,行动时间紧迫。

来自主题: AI资讯
10617 点击    2026-08-30 14:11
AI自己出题自己练!两个月狂涨11%,编码自测反超Opus 4.8

AI自己出题自己练!两个月狂涨11%,编码自测反超Opus 4.8

AI自己出题自己练!两个月狂涨11%,编码自测反超Opus 4.8

Ornith-1.5采用模型自出题、自搭脚手架、自跑轨迹的三段式强化学习闭环,在Terminal-Bench 2.1自测中以86.1分超过其自测的Claude Opus 4.8(85.0分),较两个月前的1.0版本提升约11%。

来自主题: AI资讯
8812 点击    2026-08-30 14:10
OpenAI新王Astra首测曝光,前端不存在了?

OpenAI新王Astra首测曝光,前端不存在了?

OpenAI新王Astra首测曝光,前端不存在了?

OpenAI内部代号mozaik-alpha-fdm的Astra模型扩大灰度测试,其在Max effort模式下展现的零样本前端与3D网页一次生成能力引发开发者惊叹,预计9月3日前后正式发布以正面硬刚Anthropic的Fable 5.1。

来自主题: AI资讯
9026 点击    2026-08-30 12:39
Agent记忆新范式Recuris:3B小模型到Claude Opus 5全线暴涨

Agent记忆新范式Recuris:3B小模型到Claude Opus 5全线暴涨

Agent记忆新范式Recuris:3B小模型到Claude Opus 5全线暴涨

在此背景下,新加坡国立大学、普林斯顿大学与斯坦福、牛津等研究团队合作提出了 Recuris(Recursive Experiential–Working Memory Evolution),作为首个将递归自我改进应用在记忆控制层内的智能体架构,Recuris 通过三项核心技术突破,无需训练即成功实现了从 3B 小模型到 Claude Opus 5 的全面提升。

来自主题: AI技术研报
9721 点击    2026-08-30 11:55
你的Hermes,正在使用你的身份……

你的Hermes,正在使用你的身份……

你的Hermes,正在使用你的身份……

智东西实测Hermes Agent新上线的Real Profile Browsing功能,该功能可复制Chrome登录态让Agent直接以用户身份访问网站,但实测中发现存在浏览器卡死、匿名Cookie覆盖原登录信息及macOS加密保护导致无法读取登录数据等问题,目前功能可用性仍有待优化。

来自主题: AI资讯
10210 点击    2026-08-28 23:00
「自验证」框架让开源模型反超 Fable 5,冲上 GitHub 热榜

「自验证」框架让开源模型反超 Fable 5,冲上 GitHub 热榜

「自验证」框架让开源模型反超 Fable 5,冲上 GitHub 热榜

随着开源模型能力不断提升,它们已经能够以极低的成本生成多个高质量候选方案,并进一步利用模型自身对这些结果进行验证、打分和筛选。斯坦福团队最新实验发现,使用 DeepSeek V4 Flash + LLM-as-a-Verifier 进行「自验证」,可以在 Terminal-Bench 2.1 上超越 Claude Fable 5,同时整体成本低约 11 倍。

来自主题: AI技术研报
6447 点击    2026-08-28 12:01