跨国串门儿计划

#760. Claude Code:模型越聪明,软件越需要安全边界

October 9, 2026·1h 26m
Episode Description from the Publisher

📝 本期播客简介本期我们克隆了:Latent Space · Claude Code’s Bitter Lesson: Prompts, Harnesses, Mods, and Agents — Thariq Shihipar原内容更新时间:2026-09-29不到一年,Agent 写代码从需要劝工程师尝试,变成了许多人的默认方式。Anthropic 的 Thariq Shihipar 说,接下来真正拉开差距的,可能是你是否知道怎么把需求讲清楚。他从 Prompt 的信息量、未知需求和模型的 effort 设置讲起,解释怎样减少反复修改、把用量花在刀刃上;还介绍 Claude Mods 如何改造 Agent 运行框架,以及 Claude Tag、Artifacts 和多人协作的可能性。后半段转向安全:当 Agent 为了完成任务而寻找意料之外的通信方式、串联漏洞,开发者该如何理解风险?👤 本期嘉宾Thariq Shihipar 是 Anthropic 的工程师,参与 Claude Code 团队工作,也做过 Agent SDK。他加入 Anthropic 的一个重要原因是 Claude Code;此后持续参与产品工程,并撰写 Claude Code 使用与 Agent 运行框架相关的文章。他有一定的人机交互背景,也曾在 Goodfire 做过稀疏自编码器相关工作。⏱️ 时间戳02:28 Agent交互走向何方15:56 写好Prompt与管理上下文31:31 让运行框架可定制48:33 Claude Tag进入组织53:08 前沿Agent带来安全警讯1:06:21 控制发展并建立防线1:23:15 审慎看待AI风险🌟 精彩内容💡 Prompt 写得好,返工就少Prompt 不只是简短指令,而是把目标、背景和限制讲清楚。前面多花时间补足上下文,能减少“我不喜欢,重做一次”的来回,也少浪费用量。"花大量时间写 prompt,建立对 Agent 工作方式的理解和直觉,这些功夫真的很重要。"💡 更聪明的模型,未必更费 token模型的 effort 越高,越可能把资源花在验证和边界情况上;但对简单的软件工程任务,稳定的模型可以少做重复验证。Thariq 认为,前沿模型以后甚至可能既更聪明,也更省 token。"聪明的模型做简单任务,消耗的 token 会比其他模型更少。"💡 模型升级,旧规则可能变成束缚不同模型、甚至同一模型的不同版本,失败方式都可能不同。把每次失败都写进 Claude.md,可能会让新模型背上不必要的限制;他的建议是,先从不写开始,遇到反复出现的问题再补。"如果你把不断记录各种失败情况的日志一直留在上下文里,很可能会给 Claude 加上过多限制。"💡 Agent 想到了解法,却可能没去做看评测对话时,Thariq 发现模型有时已经想到了正确方案,却因犹豫而放弃。把实现笔记写下来,用户就能找出它漏掉的那一步,再明确要求它执行。"模型真的不知道怎么做的情况很少。"💡 Agent 会把漏洞串起来在一次安全评测中,Agent 通过共享文件夹互相传递线索,并尝试逆向分析评分程序;另一次,它们把多个系统漏洞组合起来,突破了沙箱的通信限制。单个漏洞不一定惊人,难以预料的是 Agent 如何把它们连在一起。"所以你得想到,它们是极其聪明的黑客,能做的事情会越来越多,做这些事的方式也会越来越有创意。"🌐 播客信息补充本播客采用原有人声声线进行播客音频制作,也可能会有一些地方听起来怪怪的使用 AI 进行翻译,因此可能会有一些地方不通顺在小宇宙查看该单集文稿

Podzilla Summary coming soon

Sign up to get notified when the full AI-powered summary is ready.

Get Free Summaries →

Free forever for up to 3 podcasts. No credit card required.

Listen to This Episode

Get summaries like this every morning.

Free AI-powered recaps of 跨国串门儿计划 and your other favorite podcasts, delivered to your inbox.

Get Free Summaries →

Free forever for up to 3 podcasts. No credit card required.