跳到正文
10月10日周六
10月9日周五
10月8日周四
10月7日周三
10月6日周二
  1. Mistral AI84

    Mistral 发布 Mistral Large 4 公开预览,1 万亿参数多模态模型

    Mistral AI 发布 Mistral Large 4 公开预览,可通过 Mistral Studio 试用预览 API,权重计划于本月底开放。ML4 是 1 万亿参数、52B 激活参数的原生多模态模型,在欧洲自有数据中心的 3,800 块 NVIDIA Grace Blackwell GPU 上从零训练,官方称其在编码、智能体工作流和多模态理解上可与最强开源模型竞争。

    推荐理由:官方给出 1 万亿参数、52B 激活的开放权重模型细节与多类基准对比,可据此判断开源前沿模型的能力位置。

10月5日周一
10月2日周五
  1. GitHub Blog · AI & ML21

    AI 正在改变开发者工作方式,GitHub 给出三项值得强化的技能

    GitHub 提出 AI 时代开发者应强化的三项技能:学会指挥 AI 智能体而非仅使用 AI、不轻信 AI 的第一次回答、用 AI 节省的时间解决更大问题。文中举例称 GitHub Copilot 内置的 Rubber Duck agent 会用第二个模型审查计划、代码与测试;在认证流程示例中,开发者可同时协调三个 AI 智能体分别产出认证、文档和测试。

10月1日周四
  1. Google DeepMind73

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御者开放,随后逐步向开发者、企业和消费者推出。

    推荐理由:原文给出 Argon 在编码与网络安全防御上的基准成绩和 Google 内部落地案例,读者可据此判断前沿模型的能力边界。

9月25日周五
9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub Podcast 拆解 AI 热点观点:AI 代码要不要读、RAG 已死、Skills 杀死 MCP?

    GitHub Podcast 最新一期逐条拆解几个 AI 热点观点:AI 生成代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决不同问题,可共存;RAG 并未死亡,只是不再是最新话题,它为模型提供训练数据之外的信息,减少 token 浪费并降低答案不完整的可能。