首发实测,27B的源神Qwen3.8,能成为Claude Opus 4.6的轻量平替吗?
首发实测,27B的源神Qwen3.8,能成为Claude Opus 4.6的轻量平替吗?Claude Opus 4.6的轻量平替,只需要 27B 参数,你信吗?最近发布的Qwen3.8-27B,就顶着这样的评价火遍了开源社区。上线两天,下载量突破100万次,登顶Hugging Face全球大模型趋势榜。
搜索
Claude Opus 4.6的轻量平替,只需要 27B 参数,你信吗?最近发布的Qwen3.8-27B,就顶着这样的评价火遍了开源社区。上线两天,下载量突破100万次,登顶Hugging Face全球大模型趋势榜。
2023 年,Dianne Penn 加入 Anthropic 时,这家公司的产品团队只有五名工程师,整个 API 业务由一名工程师负责。当时,OpenAI 已经凭借 ChatGPT 和 GPT-4 建立起领先优势,Anthropic 还在寻找自己的产品定位。
新智元报道 Anthropic「巴拿马计划」曝光了! 2024年4月13日,Anthropic内部传阅了一份文档。 里面有这么一句:我们用一个「软代号」,因为不想让人知道我们在做这件事。 代号叫巴拿马
本周五,AI 社区热烈讨论的是一个端侧大模型部署技术,它能让笔记本 RTX 4060 跑 Qwen 3.6-35B,桌面 RTX 5090 跑得起 DeepSeek-V4-Flash 284B。而且都是单卡,模型都是满血的。Codex 生产 trace 的中位 decode 速度是 33 token/s
位于北京海淀的互联网金融中心,任利锋创办的“数美万物”在这里有3个办公地点。其中的一间不是办公室而是实验室,他们采购来市面上主流的3D打印机,在实验室桌面上次第排开,每天打印自研生成式3D模型生成的东西。经自研模型Hi3D生成的图纸打印出的实物有没有破面或其它瑕疵,又如何改进、修补,都在这间屋内见分晓。
8月13日,一篇报道把一场持续了小半年的争议直接推到了脉脉上关于美团话题的最热的位置,主角是一个AI编程领域的网红叫"阿酥在coding"。到目前为止,当事双方都没有再次回应,事情比较长,先给不了解事
这就是 Generalist 最新发布的 GEN-1.5 具身基座模型展现出的能力:模型开始从大规模人类操作数据中天然存在的重复、失误与恢复,学习到训练者没有逐项教过的动作,显露出某种智能涌现的迹象。
初创公司Groq已完成3.5亿美元融资,继续推进其从AI芯片制造商向新云公司的转型,致力于提供强大的GPU及AI基础设施服务。本轮融资由投资公司Disruptive领投,英伟达计划参与其中,此次融资对该公司的估值为35亿美元。
百灵为开发者提供了多个可继续训练的起点。今日,蚂蚁百灵开源Ling-3.0-tiny-base和Ling-3.0-flash-base。除最终Base模型权重外,团队还同步开放了两款模型的预训练和中期训练权重,共计6个checkpoints。
一个大厂程序员,辞职之后没去创业公司,也没去做 AI 项目,而是跑到了宁夏,养了一万多只羊——更离谱的是,这羊养着养着,他又重新捡起了老本行:写代码。