Python 3.15.0 加入 actions/python-versions
Python 3.15.0 已被加入 actions/python-versions,现在可以在 GitHub Actions 测试矩阵里填 "3.15" 来对新版 Python 3.15.0 跑测试。作者此前等了好几天,甚至让 ChatGPT 每小时拉取一次仓库,直到稳定版 3.15 落地再通知他。
Python 3.15.0 已被加入 actions/python-versions,现在可以在 GitHub Actions 测试矩阵里填 "3.15" 来对新版 Python 3.15.0 跑测试。作者此前等了好几天,甚至让 ChatGPT 每小时拉取一次仓库,直到稳定版 3.15 落地再通知他。
Standard Bots 的工业机械臂用共享基础模型加客户演示微调,最大模型参数量仅"low billions",感知靠十亿级图像的零样本系统,运动与单元逻辑仍用传统编程。模型在云端训练、在工厂本地 GPU 推理并输出 action chunks,以应对工厂网络不可靠。对非气隙客户,车队学习可回收失败信号与人工纠正数据。
Postman 的 Agent Mode 基于 Amazon Bedrock 运行,为 4000 万开发者提供 API 测试、文档、发现与实现的 AI 原生工作方式。
Ai2 用 GPU 时间预算、分层公平分配和时间切片契约替换了原有的优先级调度器,把"哪个项目该拿多少 GPU 时间"从事后逐个协调变成透明的预算流程。Ai2 管理数千块 NVIDIA H100、B200 和 B300,集群规模 88 到 1024 块 GPU,服务约 150 名内部研究者,待处理需求常达可用 GPU 的 2-3 倍。
Simon Willison 用 ChatGPT 桌面版 Codex 标签页的语音对话模式,在厨房做晚饭的半小时里让 GPT-6 Astra High 为博客开发出 Newsletters 索引页,含新 Django 模型与迁移、四个导入脚本、/newsletters/ 归档页、日期归档页展示和站内搜索集成。
AWS 发布基于 Amazon SageMaker HyperPod 与 EKS 的多租户参考架构,让多个团队共享同一 GPU 集群,同时保持隔离与资源公平。
作者在 HuggingChat 里开启 ML-intern,用几句提示词就在几天内训出六个模型并发布到 Hub,总计算成本约 103 美元。
推荐理由:作者公开了六个模型项目从 450 词到 2000 词的提示词写法,含基线、冒烟测试与预算控制等可迁移步骤。
Amazon Quick 和 Amazon Bedrock Knowledge Bases 在预检索 ACL 过滤之上新增实时 ACL 校验,在查询时直接向权威来源核验权限,避免同步间隙的陈旧权限漏洞。
AWS 提出 Agentic Value Model,认为以“节省工时×人力成本”衡量自动化的传统 ROI 模型是为 RPA 设计的,会漏掉 AI 智能体的大部分价值。该框架从时间节省、异常处理、决策质量和变更韧性四个维度衡量价值,并以价值实现机制作为前提;文中称修正一个错误可能花费原交易成本的 1.5–4 倍,人为错误可占运营成本的 2–15%。
Qlik 基于 Amazon Bedrock 打造 Qlik Answers,让员工用自然语言提问并获得有来源支撑的答案。该产品 2026 年 2 月正式可用,其 Discovery Agent 上线以来已为客户发现超过 10 万条异常与离群点。
GitHub Copilot 应用中的 canvas 是一种可定制界面,通过 /create-canvas 技能用自然语言描述即可生成看板、清单或仪表盘。canvas 具备双向同步能力,你和智能体可同时修改并在界面中即时看到更新,生成的 canvas 会保存为扩展供团队共享或个人复用。Awesome Copilot 还提供了发布说明、看板、issue 分诊等现成 canvas 扩展。
GitHub Copilot 提出 canvas——运行在 GitHub Copilot 应用内的全栈小应用,可无浏览器外壳运行、与 agent 双向通信,并能在本地执行代码。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向 GitHub 仓库,就能自行识别入口点、编写 harness、运行 AFL++、读取覆盖率报告并生成漏洞报告。
推荐理由:GitHub 安全实验室给出了一套可复用的自主模糊测试流水线,读者可据此判断智能体能接手多少安全测试中的重复劳动。
GitHub Copilot 应用重建了 pull request 视图,用一个 2,200 个文件、超百万行改动、400 多条行内评论的开源 PR 做压力测试。其做法是拆分两套几何:代码行高在绘制前精确已知、永不重建;评论、草稿和回复框等动态块惰性测量,修正幅度小且锚定在用户当前查看的位置。
Mistral 帮助一家欧洲能源运营商把 4 万行 Fortran 77 迁移到 C++,对象是一个无测试套件、无集中文档的物理密集型油藏模拟器。
推荐理由:Mistral 公开了用智能体迁移 4 万行 Fortran 77 到 C++ 的完整流程和三次自主度取舍,可迁移到其他遗留系统改造。