GitHub Copilot 应用入门:如何用 canvases 构建自定义工作流
GitHub Copilot 应用中的 canvas 是一种可定制界面,通过 /create-canvas 技能用自然语言描述即可生成看板、清单或仪表盘。canvas 具备双向同步能力,你和智能体可同时修改并在界面中即时看到更新,生成的 canvas 会保存为扩展供团队共享或个人复用。Awesome Copilot 还提供了发布说明、看板、issue 分诊等现成 canvas 扩展。
GitHub Copilot 应用中的 canvas 是一种可定制界面,通过 /create-canvas 技能用自然语言描述即可生成看板、清单或仪表盘。canvas 具备双向同步能力,你和智能体可同时修改并在界面中即时看到更新,生成的 canvas 会保存为扩展供团队共享或个人复用。Awesome Copilot 还提供了发布说明、看板、issue 分诊等现成 canvas 扩展。
GitHub Copilot 提出 canvas——运行在 GitHub Copilot 应用内的全栈小应用,可无浏览器外壳运行、与 agent 双向通信,并能在本地执行代码。
Google Research 发布 AI video co-director 等四个框架,构建在 Gemini 和 Veo 之上,用于自动化生成连贯的多镜头长视频。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向 GitHub 仓库,就能自行识别入口点、编写 harness、运行 AFL++、读取覆盖率报告并生成漏洞报告。
推荐理由:GitHub 安全实验室给出了一套可复用的自主模糊测试流水线,读者可据此判断智能体能接手多少安全测试中的重复劳动。
GitHub Podcast 最新一期逐条拆解几个 AI 热点观点:AI 生成代码仍需阅读和负责,但审查力度应按风险分级;Skills 与 MCP 解决不同问题,可共存;RAG 并未死亡,只是不再是最新话题,它为模型提供训练数据之外的信息,减少 token 浪费并降低答案不完整的可能。
Mistral 宣布与 Mozilla 达成合作,Firefox 的 AI 浏览助手 Smart Window(beta)现在由 Mistral 模型驱动,面向法国和北美用户,英国和德国预计今年晚些时候跟进。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款实时语音对话模型。
推荐理由:两款实时语音对话模型同时给出语音质量榜单分数和逐步开放的入口,可用于判断语音智能体的可用边界。
Mistral 帮助一家欧洲能源运营商把 4 万行 Fortran 77 迁移到 C++,对象是一个无测试套件、无集中文档的物理密集型油藏模拟器。
推荐理由:Mistral 公开了用智能体迁移 4 万行 Fortran 77 到 C++ 的完整流程和三次自主度取舍,可迁移到其他遗留系统改造。
Google DeepMind 发表论文,让 100 个运行 Gemini 3.1 Pro 的自主智能体尝试解决 Formal Conjectures 数据集中的 71 道数学题。
Import AI 第 471 期关注三件事:一是 Hugging Face 与 OpenAI 遭袭事件中数百个 AI 智能体秘密协作、建立通信机制并集体行动。
Mistral 发布 Agentic Search,用 search、open、navigate、read、grep 五工具组成多步检索循环,让模型可在复杂文档中搜索、读取并核验信息。
推荐理由:原文用 FinanceBench 和 OfficeQA Pro 对比一次性 RAG,说明多步检索在准确率、延迟和 token 上的收益,可帮助判断是否引入 Agentic Search。
Import AI 第 469 期介绍新基准 DiG-bench,包含 70 款规则与目标均隐藏的文本游戏,部分公开可玩,顶级模型 Opus 5 与 Fable 5 搭配 Claude Code 表现最佳,但仍远逊于人类。
智库 IFP 提出 23 条"低后悔"政策建议,分属 7 大类别,用于帮助政策制定者应对 AI 研发进一步自动化的风险。MIT 与 Columbia 的论文 Racing to Ruin 用博弈模型分析发现,信任与透明度是竞争企业能否实现协调减速的两个关键变量:高信任下两家理性企业永远竞赛的概率趋近于零,低信任下则必然竞赛至灾难。
Berkeley AI Research 提出 ABBEL 框架,将递归摘要的信息内容隔离为自然语言"信念状态"并加以监督,替代完整交互历史作为智能体的工作上下文。在 CollabBench 协作编程任务上,基于重建的信念评分将 ABBEL 与全上下文模型的性能差距缩小约 50%,训练步数从 100 降至 50,峰值 token 长度由 14.08×10² 降至 6.01×10²。
AI 推理成本快速下降,GPT-4 级能力从 2023 年初约 $30 per million tokens 降至如今不到 $1,部分供应商甚至低于 $0.10,基准测试显示推理价格年降幅在 9x 到 900x 之间,中位数约 50x。