SCTCAMP · AI 行动情报
每天替你删掉噪音,留下值得动手的信号。
今日判断
今天最值得点开的是宝玉整理的 Anthropic 工程师 FDE 入门课——它把"卖结果不卖软件"的交付模式讲透了,正好是你教非技术学员用 AI 提效赚钱时最缺的那层商业逻辑;其次是 n8n 社区那篇客户交付前的测试流程,把"跑绿一次不等于测过"落成了可复用的检查清单。Gemini 3.8 Live 的 97 语言实时切换和异步工具调用,是本周唯一有产品级增量的模型更新。
今天动手
用最脏样本测一遍你的工作流
一次跑通只是演示,真实客户数据里的歪斜扫描和双语文件才是翻车点。
挑一个你正在用的自动化流程,找 3 个最脏的真实输入跑一遍,记录失败位置。
我有一个自动化工作流,功能是【填写你的流程目标】。请帮我设计一组压力测试输入:1)列出 5 类最容易让流程出错的真实脏数据特征(如歪斜扫描、双语混排、手写批注);2)针对每类给一个具体样例描述;3)给出判断流程是否通过的标准(输出字段是否完整、是否需人工兜底)。只基于我提供的流程目标设计,不要假设我用了什么工具。
行业信号
04- 01
Gemini 3.8 Live 支持 97 语言实时切换
新模型还支持异步工具调用,定位是前沿价格与性能的实时音频模型。
你可以:值得跑一遍 demo,看多语言实时切换能否进你的语音类教学案例。
X - Logan Kilpatrick看原文 ↗ - 02
游戏里学的技能能迁移到真实工作吗
Good Start Labs 用铁路游戏训练 AI,其中一个版本在金融研究任务上变强了,差异来自训练设计而非游戏本身。
你可以:可做一期"训练设计决定迁移效果"的科普短视频,讲清变量在哪。
Latent Space看原文 ↗ - 03
第三方评估标准 AEF-1 获三家联署
xAI、OpenAI、Anthropic 共同签署了面向第三方评估者的 AEF-1 标准。
你可以:可整理成一页"AI 评估标准"科普,作为行业认知类内容素材。
Latent Space看原文 ↗ - 04
Agent 这次做对了,下次还会吗
标题直指 agent 可复现性问题:单次成功不等于稳定表现(仅标题可判)。
你可以:可与第 0 条合并成一个"AI 稳定性"主题的对比选题。
Hugging Face Blog看原文 ↗
可转教学/学员素材
04- 01
26 个 AI agent 全过测试却全没修好 bug
一个被植入的 bug 交给 26 个 AI agent 修,测试全绿但代码依然是坏的——说明测试通过率不能当作修复成功的证据。
你可以:可做成"AI 说修好了,你怎么验"的短视频选题,演示测试通过≠问题解决的陷阱。
Hacker News AI看原文 ↗ - 02
Anthropic 工程师拆解 FDE 交付模式
Palantir 靠几千人做到 400 万美元平均合同额,远超 ServiceNow 的 120 万,核心是客户买的不是软件也不是咨询,而是一个业务结果。
你可以:可提炼成"AI 交付卖结果不卖工具"的课程模块,讲清非技术学员如何定义交付物。
X - 宝玉看原文 ↗ - 03
交付客户前,我用最脏样本测工作流
作者的核心判断是:跑绿一次只是演示不是测试,所以刻意收集歪斜扫描、双语盖章文件等最差输入,并主动生成缺失的样本多样性。
你可以:把这份测试清单改造成学员交付前的自检表,直接进课程。
Reddit - n8n看原文 ↗ - 04
极简创业者方法论做成 Claude Code 技能
把一本书的操作手册封装成 Claude Code 的 slash skills,属于把方法论直接变成可调用工具的思路。
你可以:可拆成"怎么把一本书变成 agent 技能"的选题,演示封装过程。
Product Hunt看原文 ↗