NVIDIA PAIR:把家里的 RTX、DGX Spark 和 Mac 变成本地 AI 请求集群,但它不是“显存池化”
可以把 NVIDIA PAIR 理解成家里本地 AI 的“派单前台”:RTX 主机、DGX Spark、Mac 就像几名能力不同的员工,PAIR 看谁在线、谁装了对应模型、谁现在最空闲,就把下一份 AI 工作交给谁。它特别适合多 Agent 并发,但不会把 16GB + 24GB 显存拼成 40GB,也不会把一个大模型拆到多台机器上。
AI 工具与开源生态动态
AI 工具、模型与开源生态的资料整理与解读,低成本建立持续判断力
NVIDIA PAIR:把家里的 RTX、DGX Spark 和 Mac 变成本地 AI 请求集群,但它不是“显存池化”
可以把 NVIDIA PAIR 理解成家里本地 AI 的“派单前台”:RTX 主机、DGX Spark、Mac 就像几名能力不同的员工,PAIR 看谁在线、谁装了对应模型、谁现在最空闲,就把下一份 AI 工作交给谁。它特别适合多 Agent 并发,但不会把 16GB + 24GB 显存拼成 40GB,也不会把一个大模型拆到多台机器上。
量产爬坡启动:英伟达确认 Vera Rubin 供应链铺向30国350站点
英伟达 2026 年 7 月 21 日确认 Vera Rubin NVL72 量产爬坡,CoreWeave 基准显示同功率下 Token 吞吐为上代 10 倍。液冷成为硬约束,PCB 价值量提升 233%,微软与 Mistral 签署数十亿欧元欧洲算力协议。但 10 倍优势主要针对大型 MoE 模型,多数企业实际可用时间可能排到 2027 年。
日本启动国家级 Physical AI 基础设施:2.75 万颗 Rubin GPU 服务机器人与制造业
日本经产省支持 Noetra 与 NVIDIA 建设 140MW Vera Rubin AI 工厂,为 FRONTia 项目训练开放多模态基础模型,并把制造、物流、医疗和机器人现场数据接入国家级 Physical AI 能力。
Stargate UK 遭质疑:AI 基础设施承诺开始接受能源、选址和真实投资检验
英国 Stargate UK 数据中心项目被曝部分投资数字可能只是潜在估算,OpenAI 与 Nscale 也似乎未实地访问关键场地,AI 基础设施叙事开始回到能源和落地条件。
韩国 FINAL-Bench 展示 VKAE 推理加速:同一块 B200 上让 MoE 模型吞吐提升到 23.4 倍
韩国团队 VIDRAFT / FINAL-Bench 在 Hugging Face 发布 VKAE 推理加速结果,强调训练只发生一次,推理才是 AI 服务持续成本。文章给出了可复现实验入口和 Docker 容器,对 AI 基础设施运营很有参考价值。
韩国押注 AI 存储芯片:三星与 SK 海力士扩建 HBM 和新晶圆厂
韩国提出约 800 万亿韩元的公私合作半导体投资计划,三星和 SK 海力士将扩建新工厂与 HBM 封装能力,AI 算力竞争进一步压到存储和封装环节。
NVIDIA 扩招 Space-1:AI 数据中心开始把低轨空间纳入想象
Business Insider 报道称,NVIDIA 正为 Space-1 系统扩充空间计算相关岗位,方向聚焦低轨数据中心的 AI 软件开发,这让“太空算力”从概念讨论进入早期工程组织。
韩国押注 5180 亿美元芯片制造中心:AI 需求把三星和 SK 海力士推向更大产能战
AP 分发报道显示,三星电子与 SK 海力士计划投入约 5180 亿美元建设新芯片制造中心,以承接 AI 带来的存储和先进半导体需求。
华为昇腾在中国市场追上 NVIDIA:出口管制正在重塑 AI 芯片竞争
AP 报道称,在美国出口管制影响下,华为等中国本土芯片公司正在本土 AI 市场取得更强位置。中国 AI 竞争的关键,正在从模型发布延伸到算力自主和软件生态。