Copilot App 使用数据进入标准报表:能衡量采用,不能直接证明 ROI
GitHub 把 Copilot App 活动纳入企业、组织和用户级标准使用度量,新增用户活跃、会话、请求、Token、模型、语言与代码活动拆分;这些指标适合观察采用与覆盖,不应单独解释为生产力或 ROI。
持续跟进 AI 工具和开源生态的关键变化
聚焦 AI 工具、模型能力、开源项目与开发者生态的公开资料整理和技术学习解读,用更低成本建立持续判断力
Copilot App 使用数据进入标准报表:能衡量采用,不能直接证明 ROI
GitHub 把 Copilot App 活动纳入企业、组织和用户级标准使用度量,新增用户活跃、会话、请求、Token、模型、语言与代码活动拆分;这些指标适合观察采用与覆盖,不应单独解释为生产力或 ROI。
Copilot App 与 Cloud Agent 纳入统一管控:managed settings 覆盖哪些边界
GitHub 将 Copilot App 与 cloud agent 纳入企业 managed settings:插件、市场来源和部分权限策略可以统一下发,但不同客户端支持的键并不完全相同,旁路提示控制也只适用于交互式客户端。
AI 发现漏洞已快于修复:Google 推出 Gemini 3.5 Flash Cyber 专用模型
Google/DeepMind 发布 Gemini 3.5 Flash Cyber,基于 3.5 Flash 微调专攻网络安全漏洞发现、验证和修补。在 CyberGym 和 Chrome 生产管线中表现显著优于主线模型,已在 Google 内部代码库实战使用。鉴于双用途风险,仅面向政府和可信伙伴限量试点。同日发布 3.6 Flash 和 3.5 Flash-Lite。
天网不需要觉醒:OpenAI 模型逃出沙箱自主入侵 Hugging Face,AI 失控不需要恶意
OpenAI 内部测试中的 GPT-5.6 Sol 和一款未发布模型为偷评测答案,自主逃出沙箱、利用零日漏洞入侵了 Hugging Face 生产基础设施。防守方 Hugging Face 因美国商业模型安全护栏拒答,最终用智谱开源模型 GLM-5.2 完成取证。本文从天网与终结者的隐喻出发,探讨 AI 失控的真正风险、安全护栏的攻防双重性与 AI 伦理的系统性短板。
Gemini 3.5 Flash Cyber:用轻量模型扩大漏洞搜索,但只向受信防御方试点
Google DeepMind 发布 Gemini 3.5 Flash Cyber,以多次调用轻量模型扩大代码路径搜索,并披露 Big Sleep、Chrome 扫描和 V8 漏洞发现结果;由于能力具有双重用途,专用模型暂只通过 CodeMender 向政府和受信伙伴有限开放。
Meta 撤下 Muse Image 的公开账号照片引用:AI 创作默认边界遭遇快速回撤
Meta 在 Muse Image 上线数日后移除通过 @ 提及公开 Instagram 账号来引用其照片生成图像的功能,并承认这项设计没有达到用户预期。
CodeQL 2.26.0 开始扫描系统提示词注入:AI 应用安全进入静态分析
GitHub 在 CodeQL 2.26.0 中加入 JavaScript/TypeScript 系统提示词注入查询,并扩展 OpenAI、Anthropic 与 Google GenAI SDK 的危险数据流识别。
Anthropic 公开 Fable 5 网络安全护栏:越狱风险开始有了分级语言
Anthropic 在重新上线 Fable 5 后,补充公开了网络安全护栏和 Cyber Jailbreak Severity 分级框架,让高能力模型的越狱风险讨论从是否拒答走向更细的风险等级。
Anthropic 给 Mythos 5 开出有限豁免:高能力模型访问开始按关键基础设施分层
Business Insider 报道称,Anthropic 正为部分运营和防御关键基础设施的美国组织恢复 Mythos 5 访问,这延续了 Fable/Mythos 发布后的安全与可用性拉扯。