Anthropic 推出面向开源项目的免费 AI 漏洞扫描器
Anthropic 推出长期计划 Cyber Mission,其中免费 OSS AI 扫描器会定期检查开源项目,自动标记并解释漏洞、给出补丁建议。Anthropic 预计其准确率超过 90%,但报告未经过人工审核,可能存在错误。对基础设施或用户安全至关重要的项目维护者可通过 GitHub 申请接入。
Anthropic 推出长期计划 Cyber Mission,其中免费 OSS AI 扫描器会定期检查开源项目,自动标记并解释漏洞、给出补丁建议。Anthropic 预计其准确率超过 90%,但报告未经过人工审核,可能存在错误。对基础设施或用户安全至关重要的项目维护者可通过 GitHub 申请接入。
Amazon 宣布在与地方政府谈判数据中心交易时不再使用保密协议(NDA),此前微软今年早些时候已采取类似举措。保密做法曾引发社区对 AI 基础设施的强烈反对,从纽约到旧金山涌现数百项拟议或已颁布的暂停令。与此同时,一批初创公司正押注消费者愿意向 AI 智能体开放收件箱、文件和信用卡权限。
Amazon Bedrock 在 9 月新增由 OpenAI 驱动的托管智能体公开预览,并上架 GPT-6 Astra、GPT-6 Astra Ultrafast。
Postman 的 Agent Mode 基于 Amazon Bedrock 运行,为 4000 万开发者提供 API 测试、文档、发现与实现的 AI 原生工作方式。
Ai2 用 GPU 时间预算、分层公平分配和时间切片契约替换了原有的优先级调度器,把"哪个项目该拿多少 GPU 时间"从事后逐个协调变成透明的预算流程。Ai2 管理数千块 NVIDIA H100、B200 和 B300,集群规模 88 到 1024 块 GPU,服务约 150 名内部研究者,待处理需求常达可用 GPU 的 2-3 倍。
密码学家 Matthew Green 称,有 1% 概率我们生活在公钥加密不可能实现的 Minicrypt 世界,15% 概率将实质失去对现有公钥加密算法的信心。他指出 AI 制造意外与人类更换标准的速度相差数个数量级,只有提前准备才能从这类意外中恢复。Simon Willison 补充,Minicrypt 出自 Russell Impagliazzo 提出的假想世界。
特朗普签署行政令,禁止在可能情况下使用“AI”一词,并推动将人工智能改称“Super Intelligence”。美国 CAISI 已更名为 CAISSI,司法部新闻稿也改用该表述,马斯克、贝索斯、黄仁勋和 Sam Altman 等 AI 业界人士公开附和,但 OpenAI 表示不会改名。
Simon Willison 用 ChatGPT 桌面版 Codex 标签页的语音对话模式,在厨房做晚饭的半小时里让 GPT-6 Astra High 为博客开发出 Newsletters 索引页,含新 Django 模型与迁移、四个导入脚本、/newsletters/ 归档页、日期归档页展示和站内搜索集成。
MIT Technology Review 文章指出,AI 的拒绝机制正成为 AI 安全承重墙,但这一机制并不天然可靠。早期 OpenAI 模型会“什么都往外说”,如今模型虽被训练拒绝大量有害提示,仍会出现失败并带来暴力后果。
Sophos 借助 OpenAI 的 Daybreak 将网络威胁调查时间缩短 96%,并实现 52% 的 MDR 案例自动化,同时保留人工监督。
Asana 借助 Codex 中的 GPT-6 Astra,在测试中让其浏览器智能体成本降低 76 倍、速度提升 5 倍,从而为客户提供更强的模型。原始标题称此次优化使用 GPT-6.1 Sol。
Simon Willison 发布 ttok 1.0,把默认 tokenizer 从 GPT-4 切换为 GPT-5/GPT-6,起因是升级到 0.4 后发现默认值有误。
MIT Technology Review 将于 10 月 16 日举办线上圆桌,由资深 AI 记者 James O'Donnell 对话斯坦福大学生物工程博士生 Samuel King。King 在 2025 年借助生成式 AI 模型设计出微型病毒的基因蓝图,并因此入选 MIT Technology Review 的 Innovators Under 35;他还将谈及观察生物学的新方式。
Simon Willison 的 token 计数 CLI 工具 ttok 发布 0.4 版本,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源的 tiktoken 库,支持通过 uvx 直接运行,如 cat file.txt | uvx ttok 即可统计 token。
OpenAI 上周解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发表公开信称被辞退是因"把安全置于 OpenAI 短期利益之上",OpenAI 则称其不当处理机密信息。
NVIDIA 发文展示开发者如何用 GPT-6 Astra、Claude Fable 5 等前沿 AI 模型配合 Omniverse 库(ovphysx、ovstage、ovrtx、ovui)把仿真构想变成可运行应用。
Incarna 借助 Amazon Bedrock AgentCore payments,让 AI 智能体按次向 BlockRun 支付模型推理费用,将 x402 支付支持的开发工作从数月缩短到数天并投入生产。
Periodic Labs 的 Liam Fedus 和 Ekin Dogus Cubuk 提出「合成超级智能」构想,主张 AI 科学发现的关键不是继续用更多互联网数据训练,而是让模型在真实物理实验中学习。
AWS 发布基于 Amazon SageMaker HyperPod 与 EKS 的多租户参考架构,让多个团队共享同一 GPU 集群,同时保持隔离与资源公平。
Oracle 在招聘、工程和运营环节借助 ChatGPT Work 与 Codex,将专家知识转化为快速、可重复的工作流,把原本需要数天的工作缩短到几分钟完成。
Pollo AI 使用 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5,帮助创作者把创意转化为精细图像与电影级视频广告。
LegalOn 把每日 Codex 预估成本削减 65%,同时维持原有开发速度。该团队按任务匹配 Astra、Sol 与 Luna 模型,并对预算进行策略性管理。
尽管 Elon Musk 称 Tesla 的 Optimus 人形机器人可能以低至 2 万美元的单价自动化几乎所有人类劳动,并预测 2027 年底前面向公众发售,但许多机器人研究者认为,靠语言和图像训练出的 AI 无法应对物理世界的无限变化。Yann LeCun 在达沃斯直言,没有任何一家人形机器人公司知道如何让这些机器人聪明到真正有用。
AVEVA 首席技术官 Arti Garg 提出,随着基础模型、物理 AI 和智能体 AI 进入工业场景,AI 可直接作用于物理系统,安全与可靠性成为部署核心。AVEVA 的责任 AI 框架强调安全、效率与人类监督,主张 AI 应增强而非取代关键决策中的人。Garg 还参与 IEEE 工作组,制定覆盖电力、能源、水资源与碳排的 AI 环境影响测量标准方法。
Anthropic 发布时隔约一年的 Haiku 层级更新 Claude Haiku 5.5,定价与 OpenAI 的 GPT-6 Luna 一致,同日下调 Sonnet 5.5 缓存读取价格和订阅套餐价格。
推荐理由:除发布本身外,还汇总了第三方评测的 token 消耗与分层定价,便于判断真实成本。
微软在两年来的首场线下活动中发布新款 Surface Laptop Ultra,这是其首款采用 Nvidia RTX Spark SoC 的产品,起售价 2599 美元,配备 5120 核或 6144 核 Blackwell GPU 及最高 128GB LPDDR5x 统一内存。
作者在 HuggingChat 里开启 ML-intern,用几句提示词就在几天内训出六个模型并发布到 Hub,总计算成本约 103 美元。
推荐理由:作者公开了六个模型项目从 450 词到 2000 词的提示词写法,含基线、冒烟测试与预算控制等可迁移步骤。
OpenAI 打击了两起借助 AI 运作的影响行动,手段包括伪装成记者和一家智库来散播地缘政治叙事。
Artcraft 推出七款开源应用,复刻 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具。
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。据 Anthropic 介绍,它是 Claude 5.5 家族中速度最快、最经济的模型,面向子智能体和高并发成本敏感型任务,大多数任务成本比 Claude Haiku 4.5 低约 75%。
NVIDIA 与 Microsoft 在旧金山活动上宣布为 Windows PC 上的 AI 智能体共同设计硬件与软件,并发布 RTX Spark 笔记本与紧凑台式机。
推荐理由:RTX Spark 与 Windows PC 端本地 AI 栈的组合,给出了消费级硬件跑大模型的统一内存与算力规格。
Amazon Quick 和 Amazon Bedrock Knowledge Bases 在预检索 ACL 过滤之上新增实时 ACL 校验,在查询时直接向权威来源核验权限,避免同步间隙的陈旧权限漏洞。
美国司法部首次起诉的流媒体欺诈案中,一名男子用约 1 万个机器人和 AI 歌曲刷高播放量,被判处 18 个月监禁,并须上缴其通过该方案申报的 8,091,843.64 美元。
GitHub 发布基于 ModernBERT 的通用密钥检测分类器,用代码上下文在推送前拦截非结构化密钥,候选批量评估耗时不到 2 毫秒,并称可将可拦截的密钥数量提升一倍以上。
Liquid AI 开源 d1 决策模型家族两款模型:d1-3B 与实验性的 d1-omni-600M,均为开放权重并在 Hugging Face 上线。
推荐理由:Liquid AI 开源两款决策模型,给出端侧毫秒级延迟与七项基准对比,可据此判断小模型在边缘设备上做结构化决策的可行性。
微软亚洲研究院开源 Agent Lightning v1.0,这是一个约 3500 行代码的轻量级智能体 RL 框架,采用 Harnessed Agentic RL 范式,实现部署用 harness 直接参与强化学习训练而无需在训练框架内重写 agent。
推荐理由:Agent Lightning v1.0 不到 3500 行实现完整智能体 RL 系统,读者可了解如何在真实 harness 上训练 agent。
AWS 提出 Agentic Value Model,认为以“节省工时×人力成本”衡量自动化的传统 ROI 模型是为 RPA 设计的,会漏掉 AI 智能体的大部分价值。该框架从时间节省、异常处理、决策质量和变更韧性四个维度衡量价值,并以价值实现机制作为前提;文中称修正一个错误可能花费原交易成本的 1.5–4 倍,人为错误可占运营成本的 2–15%。
Qlik 基于 Amazon Bedrock 打造 Qlik Answers,让员工用自然语言提问并获得有来源支撑的答案。该产品 2026 年 2 月正式可用,其 Discovery Agent 上线以来已为客户发现超过 10 万条异常与离群点。
Mistral 发布新模型 Mistral Large 4,拥有 1 万亿参数,昵称 Le Chonk,任何人都可使用和定制,目前处于预览阶段,正式版将在月底前推出。
Kubernetes 创始人 Craig McLuckie 和 Joe Beda 创办的 Stacklok 已从软件供应链安全转向基于 Kubernetes 的智能体基础设施,其开源项目 Mecatl 将智能体循环与客户端、模型供应商、状态存储和执行环境解耦,ToolHive 则用于运行和管理 MCP 服务器。