Liquid AI 发布 d1-3B 与 d1-omni-600M 端侧多模态决策模型
Liquid AI 开源 d1 决策模型家族两款模型:d1-3B 与实验性的 d1-omni-600M,均为开放权重并在 Hugging Face 上线。
推荐理由:Liquid AI 开源两款决策模型,给出端侧毫秒级延迟与七项基准对比,可据此判断小模型在边缘设备上做结构化决策的可行性。
技术方向
跑在手机、电脑与边缘设备上的 AI:小模型、本地推理与端侧芯片的进展。
3 条精选近 30 天 3 条共收录 6 条
Liquid AI 开源 d1 决策模型家族两款模型:d1-3B 与实验性的 d1-omni-600M,均为开放权重并在 Hugging Face 上线。
推荐理由:Liquid AI 开源两款决策模型,给出端侧毫秒级延迟与七项基准对比,可据此判断小模型在边缘设备上做结构化决策的可行性。
Google DeepMind 发布 EmbeddingGemma 2,这是基于 Gemma 4 架构、采用 Apache 2.0 许可的开源多模态嵌入模型,可将文本、图像、音频、视频映射到统一嵌入空间。
推荐理由:Google DeepMind 开源 740M 参数多模态嵌入模型,给出端侧内存占用与向量截断方法,可供本地检索与 RAG 选型参考。
NVIDIA 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 推出 64GB 统一内存版 DGX Spark,预装 DGX OS 和 NVIDIA AI 软件栈,10 月 23 日开售,起售价 4,999 美元。
推荐理由:64GB 版本的定价、可跑 100B 参数模型和双机集群 1.7x 实测,为本地部署选型提供了具体参照。