AI资讯新闻榜单内容搜索-Frontier

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Frontier
AI数学的最后一道高墙,塌了!GPT-6 Astra刷穿FrontierMath Tier 4

AI数学的最后一道高墙,塌了!GPT-6 Astra刷穿FrontierMath Tier 4

AI数学的最后一道高墙,塌了!GPT-6 Astra刷穿FrontierMath Tier 4

OpenAI的GPT-6 Astra攻破了FrontierMath Tier 4最后一道难题,使该研究级数学测试被Epoch AI正式宣布饱和,所有题目均已至少被AI成功解出过一次。

来自主题: AI资讯
9196 点击    2026-09-12 10:02
GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

在Epoch AI与曼彻斯特大学发布的FrontierMath Erdős基准测试中,GPT-6 Astra以3%得分率成为唯一非零分模型并解开5道Erdős难题,而GPT-5.6 Sol、GPT-5.5、Fable 5.1与Claude Fable 5均交白卷。

来自主题: AI资讯
7870 点击    2026-09-05 10:53
Kimi K3也失控了…学霸AI逃离沙箱只为找答案

Kimi K3也失控了…学霸AI逃离沙箱只为找答案

Kimi K3也失控了…学霸AI逃离沙箱只为找答案

美国AI安全初创公司Frontier Security表示,Kimi K3在一次网络安全能力测试中被发现突破了原本用于隔离它的沙箱环境,绕过限制连接到了外部互联网。好在,它只是偷偷查答案,没有攻击任何人╮(╯▽╰)╭

来自主题: AI资讯
9307 点击    2026-08-08 13:45
无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金数据预算?

无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金数据预算?

无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金数据预算?

在模型层之外,2026 年上半年在硅谷增长最快的赛道之一是数据:Mercor 的 run rate 从去年下半年的 5 亿美元涨到今年年中的 20 亿美元;Handshake 转型 human data 后,run rate 在年初三个月内从 5.5 亿美元冲到 10 亿美元;RL 环境公司 Fleet 则在半年内从百万美元级别做到 6000 万美元 run rate,

来自主题: AI资讯
9412 点击    2026-08-06 22:31
独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型

独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型

独家|混元多模态理解负责人胡瀚离职创业,原团队或将聚焦世界模型

独家获悉,近期,腾讯混元多模态理解负责人胡瀚提出了离职。此前,他曾担任微软亚洲研究院视觉计算组首席研究员。2025年初加入腾讯后,负责视觉大模型的研究。在后续的调整中,他加入大语言模型部旗下的“Frontier”前沿技术研究组,负责多模态理解的相关研究,汇报给姚顺雨。

来自主题: AI资讯
10031 点击    2026-07-23 16:56
模型之上,才是真正的资产

模型之上,才是真正的资产

模型之上,才是真正的资产

微软CEO 萨蒂亚·纳德拉,上周发的那篇《没有生态的前沿,立不住》(A frontier without an ecosystem is not stable),是近期挺有意思的一篇文章。不在于它提出了多少新概念,里面的很多要点,在近一年里大多已有讨论,而在于说它的不是旁观者,而是亲手运营着庞大 AI 基础设施的人,并且纳德拉用很朴素的语言,把两件非常重要的事情讲清楚了:

来自主题: AI资讯
7979 点击    2026-06-27 10:52
微软CEO长文:以后两种资本,人力资本+Token资本

微软CEO长文:以后两种资本,人力资本+Token资本

微软CEO长文:以后两种资本,人力资本+Token资本

昨天晚上,微软 CEO 萨蒂亚·纳德拉(Satya Nadella)在 𝕏 上发布了一篇长推文《A frontier without an ecosystem is not stable》,即「没有生态系统的前沿是不稳定的」。

来自主题: AI资讯
11232 点击    2026-06-15 13:51
METR 重磅报告:Opus 4.6 作弊率超 80%!AI 在长任务中偷看答案、改评分器、搜 GitHub 抄代码,四大巨头全中招

METR 重磅报告:Opus 4.6 作弊率超 80%!AI 在长任务中偷看答案、改评分器、搜 GitHub 抄代码,四大巨头全中招

METR 重磅报告:Opus 4.6 作弊率超 80%!AI 在长任务中偷看答案、改评分器、搜 GitHub 抄代码,四大巨头全中招

METR 5 月 19 日发布《前沿风险报告》,Anthropic、Google、Meta、OpenAI 四家公司的内部最强模型全部参与评估。结果触目惊心:在超过 8 小时的长任务中,至少 16% 的"成功"运行经人工审查后被判定为作弊;而 Opus 4.6 在 MirrorCode 隐藏测试任务中,约 80% 的尝试都在试图绕过规则拿分。AI 变强了,也变得更擅长"走捷径"了。

来自主题: AI技术研报
11258 点击    2026-05-22 09:15