AI资讯新闻榜单内容搜索-GPU

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: GPU
英伟达HBM告急!下一代GPU受限,这块硬盘却抢走风头

英伟达HBM告急!下一代GPU受限,这块硬盘却抢走风头

英伟达HBM告急!下一代GPU受限,这块硬盘却抢走风头

功能型SSD在这条数据链中的合理角色,不是自行判断一段经历是否值得记住,而是在Runtime已经给出对象和策略后,靠近数据执行确定性工作。例如按租户选择密钥,按生命周期放置数据,压缩与去重可缩减的对象,维护索引页与元数据,优先完成即将被推理使用的回载,并把尾延迟、写放大和介质健康反馈给上层。语义决策留在Agent和Runtime,数据执行尽量靠近介质。

来自主题: AI技术研报
8245 点击    2026-08-11 10:22
最高节省 85% 成本:微软公布 AI 智能体 LLM 路由方案

最高节省 85% 成本:微软公布 AI 智能体 LLM 路由方案

最高节省 85% 成本:微软公布 AI 智能体 LLM 路由方案

Microsoft 发布了 一个用于在 Azure Kubernetes 服务 上路由智能体流量的参考架构。它将这个问题分解为三个关键选择:由哪个模型响应调用、如何管理调用,以及由哪个 GPU 副本处理调用。

来自主题: AI资讯
6622 点击    2026-08-10 14:43
挑战GPU、绕过HBM,深挖史上最大芯片背后的Cerebras

挑战GPU、绕过HBM,深挖史上最大芯片背后的Cerebras

挑战GPU、绕过HBM,深挖史上最大芯片背后的Cerebras

十年前,这是一家没人看好的公司。从成立第一天起,它就只想做一种从来没有被造出来过的芯片。它试图挑战英伟达的霸主地位,却在成立之初屡屡碰壁,多次濒临倒闭。

来自主题: AI资讯
8661 点击    2026-08-10 10:50
全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」

全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」

全球第一超算跑满血DeepSeek!一张GPU没用,打造超智融合「Token工厂」

在“灵晟”国产超算登顶最新一期全球超级计算机TOP500榜单后,清程极智与“灵晟”联合完成纯CPU MoE模型分布式推理方案:16节点即可流畅运行DeepSeek-V3/R1-671B模型,在batch_size=2048时,输出吞吐量与80张主流GPU集群相当。

来自主题: AI资讯
8599 点击    2026-08-08 13:35
全行业都在卷大模型,他们却用不确定微分几何给机器人做了个大脑

全行业都在卷大模型,他们却用不确定微分几何给机器人做了个大脑

全行业都在卷大模型,他们却用不确定微分几何给机器人做了个大脑

7 月中旬的一天,清华科技园的一处办公区, 一台人形机器人站在屋子中央,身后没有风扇轰鸣的 GPU 机柜,不远处是两张落满公式的书写板。

来自主题: AI资讯
8667 点击    2026-08-06 16:04
刚刚,SpaceX、英伟达宣布:AI数据中心要上天了

刚刚,SpaceX、英伟达宣布:AI数据中心要上天了

刚刚,SpaceX、英伟达宣布:AI数据中心要上天了

刚刚,SpaceX 宣布正与英伟达达成合作,共同设计 Starmind AI1 卫星计算载荷。每颗 Starmind 卫星都将搭载 NVIDIA Rubin GPU 和 Vera CPU,把接近数据中心级别的算力部署到太空。

来自主题: AI资讯
9770 点击    2026-08-05 11:28
深度|大模型厮杀背后:谁在成为AI时代的隐形 “卖铲人”?

深度|大模型厮杀背后:谁在成为AI时代的隐形 “卖铲人”?

深度|大模型厮杀背后:谁在成为AI时代的隐形 “卖铲人”?

AI行业正上演一场冰火两重天。一边是大模型公司将烧钱推向极致,万亿美元级别的开支砸向算力与研发;另一边,不练模型、不抢GPU,帮AI企业“管钱”的金融基础设施公司营收飙升。当所有人都在追问哪个模型会赢时,真正的赢家或许是这些提供AI基建的公司。

来自主题: AI资讯
6384 点击    2026-08-04 11:04
一台Mac也能跑Kimi K3!128GB内存硬塞1.6TB权重

一台Mac也能跑Kimi K3!128GB内存硬塞1.6TB权重

一台Mac也能跑Kimi K3!128GB内存硬塞1.6TB权重

有人总结,运行 Kimi K3 其实很容易,只需要 1.5TB GPU 内存、大约 8 张 H100,以及一座小型变电站。一名开发者拿出一台 128GB 统一内存的 M5 Max,直接加载 Kimi K3 发布在 Hugging Face 上的官方 MXFP4 权重。

来自主题: AI资讯
9269 点击    2026-08-01 22:54
“榨”出硅的极限:怎么让GPU不“闲着”?

“榨”出硅的极限:怎么让GPU不“闲着”?

“榨”出硅的极限:怎么让GPU不“闲着”?

这篇文章,我们邀请到了由SGLang孵化的RadixArk的联合创始人和核心成员,以及数据中心专家,一起聊聊AI Infra的四层架构、行业如何把“硅”的潜力榨到极限,以及背后的关键技术。

来自主题: AI资讯
9354 点击    2026-08-01 17:39