NVIDIA 与 Microsoft 推出 RTX Spark 笔记本和 Windows 版 DGX Station
NVIDIA 与 Microsoft 在旧金山活动上宣布为 Windows PC 上的 AI 智能体共同设计硬件与软件,并发布 RTX Spark 笔记本与紧凑台式机。
推荐理由:RTX Spark 与 Windows PC 端本地 AI 栈的组合,给出了消费级硬件跑大模型的统一内存与算力规格。
技术方向
把模型跑起来的工程实践:推理优化、显存与成本、Serving 架构与基础设施选型。
7 条精选近 30 天 6 条共收录 40 条
NVIDIA 与 Microsoft 在旧金山活动上宣布为 Windows PC 上的 AI 智能体共同设计硬件与软件,并发布 RTX Spark 笔记本与紧凑台式机。
推荐理由:RTX Spark 与 Windows PC 端本地 AI 栈的组合,给出了消费级硬件跑大模型的统一内存与算力规格。
微软亚洲研究院开源 Agent Lightning v1.0,这是一个约 3500 行代码的轻量级智能体 RL 框架,采用 Harnessed Agentic RL 范式,实现部署用 harness 直接参与强化学习训练而无需在训练框架内重写 agent。
推荐理由:Agent Lightning v1.0 不到 3500 行实现完整智能体 RL 系统,读者可了解如何在真实 harness 上训练 agent。
Google Research 发布新一代联邦学习系统,利用可信执行环境(TEE)为数据匿名化提供可验证、可审计的保证,并已应用于 Gboard。系统中,客户端设备本地加密训练数据并上传,只有符合访问策略的 TEE 工作负载才能解密处理,访问策略发布到公开透明日志 Rekor,相关二进制可从开源仓库 Confidential Federated Compute 复现构建。
推荐理由:Google 公布基于 TEE 的新一代联邦学习系统设计,读者可了解其如何让服务端处理过程可外部验证。
NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 推出 64GB 统一内存版 DGX Spark,预装 DGX OS 和 NVIDIA AI 软件栈,10 月 23 日开售,起售价 4,999 美元。
推荐理由:64GB 版本的定价、可跑 100B 参数模型和双机集群 1.7x 实测,为本地部署选型提供了具体参照。
OpenAI 的 GPT-6 Astra Ultrafast 已上线 OpenAI API,并向符合条件的 ChatGPT Work 和 Codex 用户开放,运行在 NVIDIA Blackwell GPU 上。
推荐理由:原文给出 GPT-6 Astra Ultrafast 在 Blackwell 上的提速数据与开放入口,读者可据此判断它对编码智能体循环的影响。
微软研究院发布机器人物理 AI 推理卸载的测量研究,发现将推理完全放在机器人端侧 GPU 会限制性能、续航与可扩展性,而卸载到边缘或云端 GPU 在移动操作任务中可提升成功率、支持更大模型并显著改善电池寿命。
推荐理由:微软研究院系统测量了机器人端侧推理的限制,并给出 Kubernetes 卸载方案,可迁移到具身智能部署。
Mistral 帮助一家欧洲能源运营商把 4 万行 Fortran 77 迁移到 C++,对象是一个无测试套件、无集中文档的物理密集型油藏模拟器。
推荐理由:Mistral 公开了用智能体迁移 4 万行 Fortran 77 到 C++ 的完整流程和三次自主度取舍,可迁移到其他遗留系统改造。