Claude自己长出浏览器!填表拉数,你的AI打工人有工位了
Claude自己长出浏览器!填表拉数,你的AI打工人有工位了8月26日,Claude开了自己的浏览器。
搜索
8月26日,Claude开了自己的浏览器。
随着开源模型能力不断提升,它们已经能够以极低的成本生成多个高质量候选方案,并进一步利用模型自身对这些结果进行验证、打分和筛选。斯坦福团队最新实验发现,使用 DeepSeek V4 Flash + LLM-as-a-Verifier 进行「自验证」,可以在 Terminal-Bench 2.1 上超越 Claude Fable 5,同时整体成本低约 11 倍。
大语言模型,现在真的长出手了。 本周四,Anthropic 宣布推出硬件用 MCP:Model Hardware Standard(MHS),这是一项新标准,用于帮助所有大模型驱动的 AI 智能体(Agent)安全快捷地操纵物理设备。
Claude Code 又更新了一个颇有意思的小功能。 这一次,它可以帮你起草反馈报告了。 当某个功能出现故障、Claude 发现自己犯了错误,或者你告诉它哪里出了问题时,它会自动把相关情况整理成一份报告。
就在今天一大早,全网都被刷屏了。 内部人士爆料:Fable 5.1马上就要来了! 最快,很可能明天就会发布。 而且,Fable 5.1和Sonnet 5.1很可能将同时发布。 消息的源头,
刚把Manus吐回去,Meta转头自己做了一个智能体平台“Hatch”。 小扎这是不甘心啊…… The Information消息称,Hatch功能上强调“给出目标、自动拆解并交付结果”,看着与Manus差不多吧,但非要换个宣传口径叫“消费者版的OpenClaw”。
因为一份Markdown,Claude Code可能要被踢出门了。最近,Shopify CEO Tobi Lütke突然在X上发话——我正在考虑禁止Shopify使用Claude Code。除非他们改主意,开始支持读取AGENTS.md和.agents/skills 。
今天,又有消息曝出:全新Opus 5.1模型,据传将在本周突袭发布。 从此,智能体赛道又要大洗牌了。 它有碾压级的编程能力、复杂的逻辑推理和长时间运行的AI Agent能力。单Token的智能水平,将再次被推到极限!
太夸张了! 30万亿美元。这是Anthropic准备写进招股书的数字。
哎,这谁顶得住啊。