核心价值 Andrew Ng 在 The Batch Issue 368 中提出了一个反直觉但至关重要的观点:AI 编码代理越强大,软件工程基础就越重要。 一个不懂软件工程基础的开发者用 AI 写代码,AI 会在延迟、可用性、一致性、可靠性、可维护性、简洁性和成本之间做出错误的权衡——而开发者甚至不知道这些权衡的存在。Ng 的团队将 AI 工程师所需的软件工程基础拆解为五项:构建全栈应用、数据管理、系统架构设计、安全与可靠性、生产环境扩展与运维。 其中数据管理被特别强调,因为数据是软件的基础,一旦选错架构,AI 不会知道它"不知道什么"——这需要你带着上下文去干预。Ng 还指出,Architecture 是"移动靶":原型阶段的简单架构未必适合第一个生产系统,而生产系统也需要随着规模扩大而演进。懂得这些,才能驾驭 AI 编码代理做出正确的技术决策,而非被动接受 AI 的默认选择。
对我的启发 这个框架对正在使用 AI 编码代理的人有三个直接应用场景:(1) 在每次启动 AI 编码任务前,先明确约束条件——不要只告诉 AI"做什么",还要告诉它"在什么约束下做":延迟要求、并发量级、数据一致性级别、成本预算。这些是你作为工程师必须提供的上下文,AI 不会替你问。(2) 把数据架构决策权握在自己手里——Ng 特别强调数据管理需要"显著的人类上下文",因为 AI 不知道你的数据访问模式、查询频率、未来可能的扩展方向。在让 AI 帮你设计数据库之前,先自己想清楚:查询模式是什么?读写比例?数据量级?(3) 学习 Ng 的 AI 工程技能图谱——如果你正在构建 AI 应用,今天就可以对照这五项技能做一次自我评估:哪一项是你的短板?哪一项正在拖慢你的项目?找到最弱的一项,优先补齐。
原文摘抄
核心价值 AI Agent 在执行长任务时,上下文窗口会不断膨胀。传统做法是按固定规则删除最旧内容或工具输出,但这种方法经常误删后续需要的关键信息。小红书团队提出 Self-GC(Self-Governing Context),让一个 Planner LLM 来决定每个上下文条目应该保留、压缩(Fold)、缩短(Mask)还是删除(Prune)。关键创新在于:Planner 不是盲目执行,而是先估算执行这些操作能节省多少 token 成本,只有当节省超过 30% 时才真正执行。在真实用户对话回放测试中,Self-GC 保留了必要细节的 85-95%,远高于规则方法的 55-70%。
对我的启发 这个思路可以直接迁移到日常使用 AI Agent 的场景中。如果你在用 Agent 做长任务(比如多轮代码调试),可以主动要求 Agent 在上下文过长时"先总结已完成的步骤,标注哪些信息后续可能需要,再删除冗余内容",而不是简单地说"总结一下"。更进一步,可以把这个逻辑写入 Agent 的系统提示中,让它自动管理自己的上下文。
原文摘抄
核心价值 同一周内,OpenAI 发布 Ultrafast(GPT-5.6 Sol 在 Cerebras 硬件上运行,吞吐量达 750 token/秒,是标准 API 的 11 倍),Google 发布 Gemini 3.7 Flash(330 token/秒),Nvidia 发布 Nemotron 3.5 Lightning(302 token/秒)。The Batch 指出,这个速度级别改变了模型"能做什么"而非仅仅"做得多好":语音助手在 1 秒延迟内才感觉自然,Agent 写代码超过几分钟等待就容易分心,实时监控类 Agent 需要秒级响应。速度正在从"nice to have"变成"决定产品形态"的因素。
对我的启发 如果你在构建 AI 产品,现在就应该把"延迟预算"纳入产品设计。问自己:用户等待 2 秒和 10 秒的体验差异有多大?如果延迟降到 1 秒以内,产品的使用场景会发生什么变化?考虑使用速度更快的模型(如 Flash 系列)来替代大模型处理对延迟敏感的任务,让大模型只处理需要深度推理的部分。
核心价值 发表在《Nature Aging》上的一项研究用深度学习模型扫描了 25,000 多张组织图像,发现人体器官有三种截然不同的衰老模式:(1) 早期加速型(如血管,30-39 岁加速衰老后放缓);(2) 晚期加速型(如子宫和阴道,50-59 岁才加速);(3) 双峰型(大多数器官,包括整个消化道,在 30 多岁和 50 多岁各出现一次加速衰老高峰)。更令人惊讶的是,消化系统和生殖系统之间存在跨系统协调——如果一个人的结肠和食道加速衰老,他的前列腺也大概率在加速衰老。研究者推测这可能是通过激素信号实现的。
对我的启发 这个发现对个人健康管理有直接意义:(1) 30 多岁和 50 多岁是两个关键窗口期——大多数器官在这两个阶段经历加速衰老,这意味着在这两个年龄段进行健康干预(饮食调整、运动、体检)的边际收益最大。(2) 不要只看单一器官指标——消化系统和生殖系统之间存在的协调关系意味着,一个系统的异常可能是另一个系统问题的早期信号。比如消化道问题可能预示着生殖系统需要关注。(3) 衰老不是"均匀磨损"——这个认知框架可以帮助你理解为什么某些健康问题在特定年龄段集中出现,从而更有针对性地规划体检和预防。
原文摘抄
核心价值 沟通专家 Chris Fenning 在 TEDxEindhoven 演讲中指出:工作中的大多数低效沟通,根源不在内容本身,而在前 60 秒没有说清楚"我到底想说什么"。 他提出了一个三步框架来组织任何工作对话的开场:第一步,明确你要讨论的具体情境(Context);第二步,说出你的核心意图或目标(Intent);第三步,用一句话概括关键信息(Key Message)。Fenning 的核心洞察是:大多数人开场时先给背景、再给细节、最后才说结论——而听众在前 60 秒内如果没听到重点,注意力就已经飘走了。
对我的启发 这个框架可以直接应用到日常工作中:(1) 发消息前先写"一句话结论"——在微信、飞书或邮件中,把最重要的那句话放在第一行,而不是藏在第三段。(2) 开会前准备"60 秒开场白"——每次会议发言前,先在脑子里过一遍:情境是什么?我的意图是什么?关键信息是什么?如果这三句话不能在 60 秒内说完,说明你还没想清楚。(3) 用这个框架给 AI 下达更清晰的指令——把你的 prompt 也按 Context → Intent → Key Message 组织,AI 理解会更准确。
核心价值 荷兰央行行长透露,今年 3 月至 8 月已将约 86 吨黄金(价值约 120 亿美元)从纽约和渥太华转移至伦敦,使伦敦成为荷兰黄金储备最大单一托管地(占比近三分之一)。核心理由是全球地缘政治不确定性上升,以及伦敦是全球流动性最强的黄金市场。这一举动并非孤立:法国央行近期也将存放于美国的黄金调回巴黎,德国反对党则在议会动议要求将所有境外德国黄金运回国内,理由是特朗普政府可能将控制美国境内德国资产作为对德施压筹码。世界黄金协会最新调查显示,越来越多的央行正寻求将黄金储备多元化分布或运回本国。
对我的启发 这个趋势有两个值得关注的信号:(1) 黄金作为"信任锚点"的角色正在回归——在地缘政治不确定性上升的背景下,各国央行不再把黄金储备视为"过时的遗产",而是将其重新定位为危机时刻的终极流动性工具。这对个人资产配置也有参考意义。(2) "去美元化"不仅是贸易结算层面的趋势,也延伸到了储备资产的物理存放地选择——各国不再默认将黄金存在美国,这反映了对美元体系长期信任度的重新评估。理解这一点有助于判断未来全球金融体系的演变方向。
原文摘抄
核心价值 博通发布最新财报,上季营收同比增长 86%,其中 AI 芯片收入同比增长约 200%。公司同时将全年 AI 业务营收指引从 560 亿美元上调至 580 亿美元。这一数据与微软财报将 Azure 与 Office 合并为"Agents and Infra"业务、Snowflake AI 收入"显著跃升"等信号叠加,表明AI 基础设施投资周期仍在加速而非见顶。博通作为 AI 芯片(定制 ASIC 和网络芯片)的核心供应商,其业绩是判断 AI 投资是否持续的最直接指标之一。
对我的启发 这个数据对判断 AI 行业趋势有直接价值:(1) AI 基础设施投资远未到顶——博通 200% 的 AI 芯片增长意味着云厂商和企业的 AI 算力需求仍在快速攀升,这会持续压低推理成本、推动更多 AI 应用落地。(2) 定制芯片(ASIC)正在成为趋势——博通的增长很大部分来自为云厂商定制 AI 芯片,这说明大厂正在从"买 GPU"转向"自研芯片",这对整个 AI 硬件生态有深远影响。如果你在做 AI 应用,持续下降的推理成本意味着你可以更大胆地使用更多 token 来提升产品体验。