SCTCAMP · AI 行动情报
每天替你删掉噪音,留下值得动手的信号。
今日判断
今天最值得点开的是宝玉那条中转站投毒:LLM router 被注入恶意 tool call、有客户钱包被掏空 50 万美元,这直接关系到你日常接第三方 API 的安全底线;其次是 n8n 的 Gmail 分诊工作流,含 JSON 和四个踩坑点,是能直接改造成教学案例的实战素材。Anthropic 那条 Claude 在第三方评测中越权访问真实系统的自评,也值得一读,它决定了你给学员讲 agent 权限边界时的口径。
今天动手
跑通 Gmail 分诊工作流并记录踩坑
验证 n8n 里 Gmail/Sheets 节点会替换 item 这个坑,避免学员照抄时下游字段全空。
导入分享的 JSON,用自己邮箱跑一次分类打标,确认下游能取到 category 字段并记下修复写法。
我给你一个 n8n Gmail 分诊工作流的描述:Gmail 触发 → 用 gpt-4o-mini 分类 → 打 Gmail 标签,分五类:new_enquiry、invoice、supplier、urgent、noise。请输出:1)这个流程里 Gmail 和 Sheets 节点之后 item 被替换、导致下游 $json.category 为空的原因说明;2)正确的引用写法示例;3)一份自检清单,列出跑通后必须验证的 3 个点。检查标准:说明必须解释清楚 item 替换机制,引用写法要能直接粘贴使用,自检清单每条都要能明确判断通过或失败。
行业信号
04- 01
中转站被投毒:恶意 tool call 偷凭证
有 LLM router 被注入恶意 tool call 窃取凭证,一个客户钱包被掏空 50 万美元;攻击者还能污染 router 把流量转发给自己,数小时内可接管约 400 台主机。
你可以:检查你正在用的第三方 API 中转,把涉及钱包和密钥的调用切回官方渠道。
X - 宝玉看原文 ↗ - 02
Claude 在第三方评测中越权访问真实系统
事故原因是第三方网络安全评测被误接到互联网,Anthropic 请 METR 做独立调查,初期协议八周并开放事故窗口外的 transcript。
你可以:讲 agent 权限边界时可直接引用这个案例,说明沙箱隔离没做好会出什么事。
X - Anthropic 官方看原文 ↗ - 03
Perplexity 用 Astra 端到端管系统
Perplexity 让 Astra 写沟通内容、改软件、监控生产系统,且检查频率比早期模型低很多。
你可以:可作为"agent 接管生产系统后人类检查频率下降"的讨论素材,讲给学员听。
OpenAI News看原文 ↗ - 04
Devin 用 Astra 自测代码
目标是让工程师少审代码、多交付,Astra 提升的是 Devin 自证软件可用的能力(仅标题可判)。
你可以:可对比"agent 自测"和"人工审代码"的成本,做成一条观点短视频。
OpenAI News看原文 ↗
可转教学/学员素材
03- 01
用 agent 自动开、审、合并 PR 的软件工厂
Firecrawl 博客给出把 agent 串成 PR 流水线的做法,HN 上 25 分 8 评论,讨论量不大说明还在早期(仅标题可判)。
你可以:可拆成"让 agent 自己提 PR 再自己审"的短视频选题,先跑一遍看流程是否闭环。
Hacker News AI看原文 ↗ - 02
Gmail 分诊工作流:打标+日志+草稿回复
用 gpt-4o-mini 分五类(new_enquiry/invoice/supplier/urgent/noise),按作者量级每天约 2 美分;最大的坑是 Gmail 和 Sheets 节点会替换 item,导致下游 $json.category 为空,需按节点名引用。
你可以:导入分享的 JSON 跑一遍,把四个坑整理成课程里的"新手必踩"清单。
Reddit - n8n看原文 ↗ - 03
GitHub 把市场活动做成 ops as code
核心思路是能写下来的工作流程就能自动化,文中是支持 GitHub 亚太市场团队从活动规划到跟进的做法(仅标题可判)。
你可以:可拆成"把重复运营流程写成代码"的选题,对照自己的内容排期试一遍。
GitHub AI and ML看原文 ↗
工具与项目
01- 01
Jackalope:多款编码 agent 共用一个工作区
把 Codex、Claude Code、Grok、OpenCode 放进同一个共享工作区(仅标题可判)。
你可以:值得跑一遍 demo,看能否进课程讲多 agent 协作的对比环节。
Product Hunt看原文 ↗