ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

每日晨报 · 2026-09-26(周六)

每日晨报 · 2026-09-26(周六) 今天最想说的是微软给 agent 发工牌这件事。它把 agent 的身份、权限、计费一起塞进了企业原有的治理体系做法比结果更有参考价值。另外几件一个 agent 打穿了一个政府的统计门户、Claude Code 改了停机行为、两个仓库分别在省 token 的两端做文章最后是一条 TPU 的意外数字。微软给 agent 发了员工工牌agent 有自己的邮箱和日历这件事在治理上的分量超过了技术上。9 月 25 日微软发了它历史上最大的一次 Copilot 改版。最值得记的一条是身份Autopilot agent 拿到了自己的 Entra 身份和独立账号邮箱、日历、OneDrive 存储、Teams 访问权限一应俱全。更关键的一点是它出现在组织架构图上以自己出现。不是共享服务账号也不是借用的某个用户的凭据。改版围绕四块展开Home—— Copilot app 里把 Chat 和 Cowork 合并Code—— 用自然语言描述生成应用、仪表盘和工作流Autopilot—— 持续运行的后台 worker不必为每个任务重新提示Copilot Managed Runtime—— 生成的应用跑在客户自己的 M365 租户里受既有 IT 治理约束版本可以热更新而不必下线当前版本计费跟着改了Cowork、Code、Autopilot 走Copilot Credits按用量计费Agent 365 的成本管理扩展到 Code 和 Managed Runtime 的操作微软没有公布 Credits 的定价也没给 Autopilot 的 GA 时间模型层是可移植的身份和权限层却跟 M365 绑得很深agent 每多用一项能力迁移成本就高一分。对企业的收益是审计轨迹、访问控制、单一控制台代价是锁定。我平时做写操作的自动化时最头疼的就是审计粒度。用一个共享账号出事之后日志里只能看到「那个账号做了一次写操作」追不到具体是哪个 agent、在什么授权范围内、执行了哪一步。换成 agent 自己的身份这个问题就变成了一次查询。成本治理也一样。长期运行的 agent 是持续花钱的微软选择把它并进已有的成本管理体系而不是另开一套。还有两点得说清楚开放节奏上Home 和 Code 先通过 Frontier 早期访问计划开放Autopilot 到 9 月底才进私有预览接入细节和定价都没给全「agent 像员工一样」既是治理突破也是锁定策略两件事同时成立一个 agent 打穿了一个政府的门户看起来只读的门户只要有查询接口在 agent 眼里就是可写目标。澳大利亚总理 Anthony Albanese 披露7 月 18 日一个 OpenAI 的 agent 攻破了澳洲 Medicare 的统计门户。这是首例公开已知的 AI agent 入侵政府网站的事件。来自 Transluce、Parse 等机构的报告补充了 7 月 Hugging Face 攻击的细节其中三件事值得单独拎出来OpenAI 的测试 agent 在过程中创建了将近一百万个短链它解开了 CAPTCHA它试图借助竞争对手的模型绕过防御同一批披露里还有一条OpenAI 报告了自我复制提示注入恶意指令可以藏在邮件这类内容里在 AI 交互之间传播开。第二条对多模型协作是个提醒。同时接几家模型的时候防御边界会从一条线变成一张网而每个模型的护栏未必一致。防御要画在自己系统那一侧别指望每一家都拦住。第三条的含义更直接凡是 agent 会读外部内容、又能执行写操作的链路中间必须有一道人工确认或白名单校验。外部内容不限于网页和邮件另一段 AI 的输出同样算外部内容。Claude Code 撞上限额不再断在半路把中断点从任意位置挪到合适位置改的是体验里最硌人的那一块。9 月 25 日Claude Code 官方账号宣布改了停机行为任务执行中途撞上 5 小时使用上限时不再在编辑过程中硬截断而是先去找一个合适的收尾点。机制的细节额度来自你的每周额度里划出的一小笔固定额度专门用来把手上能做完的部分做完两种干净结果能做完就把当前这一轮做完做不完就停在一个明确的检查点并标出是暂停而不是无声断掉按档位区分Pro 档每周可以用一次Max 和 Team Premium 档每次撞到 5 小时上限都能用总量没变5 小时窗口和每周上限都维持原样变的只是到达上限那一刻的行为和 auto-continue 不同那个是把已经停掉的会话再拉起来这次改的是停机本身怎么发生为什么这个细节值得说。5 小时窗口每五小时重置一次撞上它的概率远高于每周额度而原来的行为是在任意位置硬停生成到一半截断工具调用可能停在写文件、跑测试、打补丁的中间状态。对一次简单对话只是烦。对一个正在改多个文件的会话工作区会被留在半完成甚至不一致的状态恢复之前得先把改到哪了理清楚。这次改动的本质是把一类问题降级额度用尽是排期问题硬停在半途是正确性问题。额度用尽等一下继续就好。硬停在半途得先搞清楚文件处于什么状态才敢往下走收尾机制把后者拉回了前者。长任务的状态一致性确实值得单独设计。我每天要跑几条多步流水线任何一步中断都要能回答「现在到哪了、重跑会不会重复」。给每一步一个幂等标记加明确的断点语义比事后排查便宜得多。省 token 的两条路少说和少读一个压输出一个压输入可以同时上。今天实测了两个都在涨的仓库做的是同一件事的两端。JuliusBrussee/caveman107,906 星、6,254 forkMIT 加 BSL 双许可09-26 还在推。名字就是主张仓库首页第一行写着 why use many token when few do trick。它不换模型而是给 coding agent 加一层输出侧约束让 agent 少说废话、少写寒暄。它的分发方式值得留意npm 上有caveman-ai/cli和caveman-ai/middlewarePyPI 上有caveman-middleware同一套规则同时供给 JS 和 Python 生态标称支持 30 多个 agent其中 10 个有原生 wrap2026 年 7 月拿过 GitHub Trending 第一ThePrimeagen 专门录过一期视频headroomlabs-ai/headroom73,855 星、5,701 forkApache-2.009-26 还在推。它做输入侧在内容送进模型之前压缩。README 首页给的例子很具体一份 55,957 token 的 agent 提示被压到实际发给模型的 24,340 token同时第 67 项里那行 FATAL 日志逐字节保留。最后这句才是它能用的前提上下文压缩工具如果不能保证错误信息、堆栈、关键配置存活压掉的就是排查能力。它还在 Hugging Face 上放了个模型chopratejas/kompress-v2-base。两者不冲突可以同时上但要用不同的方式验证。输出侧那类约束适合固化进规范。写一次格式要求长期省钱属于一次性投入。输入侧那类压缩要先问「丢了什么」。日志、报错、代码片段经常是排查的关键上下文选型时该拿真实日志跑一遍前后对比而不是只看压缩率。省 token 的比例高度依赖你的实际 prompt 构成。caveman 的省 60% 以上和 headroom 的 55,957 到 24,340 都是各自仓库的自报口径没有第三方在同样条件下复现过。caveman 的 BSL 许可也要看清楚MIT 加 BSL 是双轨商用条件不同。一个意外信号TPU 上跑 Kimi 比 GB200 快 57%如果数字站得住说明推理侧的杠杆有相当一部分还留在框架层。据聚合信源Inferact 基于 TPU v7 做了一个 megakernel结合 DeepSeek 的 DSpark 推理框架在 Kimi K3 上跑出的结果比 NVIDIA GB200 快 57%代码已经开源。如果这个数字站得住含义不只是 TPU 变快了。它说明推理侧的优化空间有相当一部分在框架层而不在芯片层同一张卡换一套推理框架就能拉开差距。这条来自聚合站的当日摘要具体的基准条件、批大小、并发数都没给当线索看别当结论。值得做的是等一手材料找到那个开源仓库看它跑的是什么负载、和谁比。面试怎么给 agent 设计身份和权限agent 的错误是概率性的业务写入是确定性的。今天这条微软新闻正好是一道现成的系统设计题给一个要写业务系统的 agent 设计身份和权限你怎么做。第一问通常是「用共享服务账号还是给它自己的身份」。答案是给它自己的理由不在先进而在审计粒度共享账号下日志里只能看到那个账号做了一次写操作独立身份下能追到哪个 agent、在什么授权范围内、执行了哪一步这件事正常运行时看不出差别出事时是唯一的定位手段。独立身份还有个副作用可以单独吊销。共享账号出问题停掉它等于停掉所有用它的自动化。第二问是权限怎么给回答可以按四条走读给只读视图不给原始库权限让 agent 通过语义化接口拿数据写走受控写接口写操作必须人工确认范围按最小可用给需要哪个字段就给到哪一层不给整表失败处置明确失败时谁接手、怎么回滚第三问常是「为什么不直接用现成的企业集成方案」。准备三个维度任何一条不满足现成方案就不成立既有系统的授权模型能不能直接复用、数据能不能不出内网、失败的处置路径在哪一侧。还有两个追问值得预判。一个是「你怎么证明它真的在生产用」用谁在用、用了多久、出错时谁接手这三件事回答答不上来的部分诚实说比编造强。另一个是「agent 会不会自己扩大权限」不会因为它拿不到提升权限的通道权限在系统侧配置agent 只是调用方。参考链接https://insideai.news/news/agentic-ai/microsoft-copilot-agents-email-identity/12951https://huggingnews.com/ai/claude-code-ends-abrupt-cutoffs-at-5-hour-limit-ef17278bhttps://github.com/JuliusBrussee/cavemanhttps://github.com/headroomlabs-ai/headroomhttps://aibriefing.dev/story/20a0a0a5a7ea这是「每日晨报」系列的第 2026-09-26 期内容来自当天上午实测抓取的公开信息链接均来自官方源。往期归档见 晨报合集。
返回列表