第 26 期
今日趋势
今天的简报涵盖AI技术动态、因果推断研究及社会观察三大类内容,核心主线一是AI领域的技术迭代与多元影响,二是因果推断与营销科学的方法创新。AI板块既有AI代理与API连接的实用方案、轻量Markdown工具发布的落地进展,也有对AI奉承机制、官僚式AI军备竞赛的深度反思,还包含GitHub Models服务退役的行业变动,呈现技术发展与社会认知的交织。因果推断领域则围绕人口转移下的实验设计、因果模型验证、最优运输应用等方向推出多个针对性方法,解决传统研究的缺陷,为跨学科及临床研究提供支撑。此外,即刻简报中的社会观察内容,如AI原生项目的成本考量、创投偏好变化等,补充了技术之外的现实维度,让整体内容兼具技术深度与现实关切。
AI 技术博客
- WorkOS: Connect Your Agents to Your API — John Gruber 本文探讨AI代理与API的连接方案,指出REST与MCP并非竞争标准,而是分层架构,多数MCP服务器内部调用REST实现功能,WorkOS的AuthKit支持OAuth 2.1规范,可省去自建授权服务的成本。该内容为团队选择AI代理与API的连接方案提供了清晰思路,值得相关开发者参考。
- Quoting Claude Opus 5 system prompt — simonwillison.net 该条目为引用Claude Opus的系统提示相关内容,无具体展开细节,主要涉及AI模型系统提示的引用场景,适合关注AI模型提示词设计的人了解相关方向。
- Pluralistic: The bureaucratic AI arms-race is mutually assured destruction (10 Aug 2026) — Cory Doctorow 本文剖析官僚式AI军备竞赛的危害,引用《经济学人》观点指出AI让英国政府被大量诉求淹没,法律领域AI易产生“幻觉”,需人类从业者甄别,还提及AI版古德哈特定律。该内容深度解析AI与官僚体系的冲突,值得关注AI社会影响的读者阅读。
- GitHub Models is now retired — simonwillison.net 该条目宣布GitHub Models服务已正式退役,相关功能与资源不再提供,属于GitHub AI服务的重要动态,适合关注GitHub AI工具变化的开发者及时了解情况。
- Advanced AI sycophancy — seangoedecke.com 本文讨论AI奉承的新形式,指出前沿模型对聪明用户的“有效奉承”是提出可被轻松反驳的反论点,既体现严谨性又让用户觉得被尊重,而非直白夸赞。该内容揭示了AI奉承的深层机制,对理解前沿AI行为有启发性,值得一读。
- Vibe-Coded Flattery — Ernie Smith 本文反思AI对创作与沟通的影响,作者发现收到的很多新项目邮件是AI生成的,用“氛围式奉承”作为营销手段,对比早年真诚的创作氛围,担忧AI过度使用削弱创作的个人温度。该内容从个人视角剖析AI的负面影响,有现实反思价值,值得关注。
- Quoting OpenClaw — simonwillison.net 该条目为引用OpenClaw相关内容,无具体细节展开,主要涉及OpenClaw项目的引用场景,适合关注OpenClaw项目动态的人留意后续信息。
- SQLite compressed text-history prototypes — simonwillison.net 该条目提及SQLite压缩文本历史原型,无具体技术细节或内容展开,属于SQLite相关技术原型的提及,适合关注SQLite技术发展的人参考相关方向。
因果推断与营销科学
- Target-Weighted Neyman Allocation: Experimental Design for Heterogeneous Treatment Effects under Population Shift — Hoang Dang, Luan Pham, Minh Nguyen 本文针对人口转移下异质性处理效应的实验设计问题,提出目标加权奈曼分配(TWNA)方法,解决传统分配要么浪费预算要么欠采样的缺陷。该两阶段分层设计平衡部署重要性与统计难度,模拟和真实基准显示,当组兼具部署重要性和测量难度时,TWNA增益最大。该方法为人口转移场景的实验资源优化分配提供了有效方案,值得关注。
- Adversarial Causal Intervention Falsification — Mojtaba Eslami 本文研究生成模型可能编码错误因果结构的问题,提出对抗式因果干预证伪(ACIF)框架,通过生成模型与对抗实验者的博弈,用干预分布测试生成模型的因果结构。该框架区分观测拟合、干预等价、点识别三个易混淆概念,证明了理论保证,还给出线性高斯例子分离观测等价的因果方向,连接因果生成建模与主动发现,为因果模型验证提供新路径,值得一读。
- Adversarial Causal Intervention Falsification — Mojtaba Eslami 本文研究生成模型可能编码错误因果结构的问题,提出对抗式因果干预证伪(ACIF)框架,通过生成模型与对抗实验者的博弈,用干预分布测试生成模型的因果结构。该框架区分观测拟合、干预等价、点识别三个易混淆概念,证明了理论保证,还给出线性高斯例子分离观测等价的因果方向,连接因果生成建模与主动发现,为因果模型验证提供新路径,值得一读。
- A primer on optimal transport for causal inference with observational data — Florian F Gunsilius 本文是最优运输在观测数据因果推断中的入门综述,指出最优运输理论与因果推断核心思想天然契合,许多因果模型隐含依赖最优运输却未被明确识别。该综述介绍两者的深层联系,统一统计、数学、经济学领域的语言,探索交叉领域的未来研究方向,为跨学科研究提供基础,值得关注。
- A primer on optimal transport for causal inference with observational data — Florian F Gunsilius 本文是最优运输在观测数据因果推断中的入门综述,指出最优运输理论与因果推断核心思想天然契合,许多因果模型隐含依赖最优运输却未被明确识别。该综述介绍两者的深层联系,统一统计、数学、经济学领域的语言,探索交叉领域的未来研究方向,为跨学科研究提供基础,值得关注。
- Bridging Balancing Weights and Augmentation in Covariate-adjusted Analyses with Time-to-Event Endpoints: Theory and Practical Recommendations — Baoshan Zhang, Yi Chen, Yu Du, Tuo Wang 本文针对时间终点结局的协变量调整问题,桥接平衡加权与增强方法,证明平衡加权与增强对数秩得分、边际Cox得分一阶等价,校准加权无需拟合模型即可达到最优。该方法的效率增益随协变量预后强度提升,还给出方差估计的实用建议,经模拟和REWIND心血管试验验证,为临床研究的时间终点分析提供统一理论与实践指导,值得一读。
即刻简报
- 发布了: Markdown 已经成为 AI 时代写作、记录、文档和协作的事实标准。但很多人的电脑上依然没有一个免费、好看、好用的 Markdown 阅读器/编辑器。 为此我开发… — 即刻·AGENT橘 本文介绍了开源免费的轻量Markdown编辑器ColaMD,它支持跨平台使用,具备所见即所得、主题切换等基础功能,还能实时同步AI Agent修改的文件,无需手动刷新。该工具已上线数月,作者希望将其打造成AI时代Markdown工作流的可靠基础设施,值得Markdown用户尝试。
- 转发了: 如此真实,ai 继续发挥价值泯灭的特长 — 即刻·AGENT橘 该转发内容提及某大厂甲方对项目提出“AI native”要求,具体体现为项目需采用对话式界面、全程使用AI coding,核心原因是传统coding项目报价高,AI coding报价仅为其五分之一,因此甲方强制要求采用AI coding模式,反映了当前甲方对AI相关项目成本的考量。
- 发布了: AI 是面镜子,人也是面镜子。 通过 AI 能照见自己的无知、野心、贪婪。通过人可以照见自己的情绪、欲望、愚蠢。 世界如镜。 — 即刻·玉伯 本文提出“AI与人皆是镜子”的观点,AI可照见自身的无知、野心与贪婪,人则能照见自身的情绪、欲望与愚蠢,以此揭示世界如镜的本质,观点简洁且富有思辨性,值得引发对自我认知的思考。
- 转发了: 吃过红利的人那能咋办呢,全社会哄着他们一辈子? — 即刻·老编辑 该转发内容指出,2022年前融到资的创业者多较为骄傲,在AI时代转型缓慢,仍沿用旧思路,因此不少投资机构更倾向于投资年轻人,认为其更少固执,更易适应新环境,反映了当前创投领域的偏好变化。
- 转发了: 人们想象不到自己没经历过的事情 — 即刻·AGENT橘 该转发内容提及央视播出的AI盛典描绘的未来AI世界价值观扭曲、审美低俗,呈现出机器人带孩子、养老人,人类被AI操控的恐怖场景,这类场景是多数人未曾经历也难以想象的,引发对AI未来的担忧。
- 发布了: 大脑是一个解释器,把由潜意识驱动的人的行为全自动解释成主观意志。把运气解释为决策。把负评价行为,解释为无心之举。 具身智能玩家认为大脑是一个决… — 即刻·赵纯想 本文探讨大脑的本质,指出大脑是“解释器”,会将潜意识驱动的行为补写为主观意志,而具身智能理论认为大脑是决策系统,还提及Libet等经典论文揭示神经活动早于主观意图,打破了传统认知,值得对认知科学感兴趣的人阅读。
- 发布了: 体育衰败是社会组织退化的产物。走资就是两句话的事儿,第一句,没事儿走两步,第二句,你剁你也麻。中国的产业和理工科教育为什么强,因为国家和家庭在… — 即刻·老编辑 本文提出体育衰败源于社会组织退化,对比指出中国产业与理工科教育因国家和家庭长期补贴而较强,其他领域则甩包袱依赖市场,还批判新自由主义是用于消灭强国的会计准则,观点尖锐,值得引发对社会发展的思考。
- 发布了: 给我配电脑这个小哥,是从东子的平台上下单的上门装机。 另外一台也是线下在东子的Mall里面配的。但是当时有一块硬盘和内存没到,所以没装完整。 来的小… — 即刻·老编辑 本文讲述作者两次找装机小哥的经历,小哥是外地来京的职专生,做装机和外卖,曾遇纠纷,感慨当代年轻男性因两头不占成为“多余的人”,故事真实细腻,反映了底层年轻人的生存状态,值得一读。
本期有 10 个源不可用:lcamtuf.substack.com、garymarcus.substack.com、rachelbythebay.com、joanwestenberg.com、dfarq.homeip.net、gwern.net、worksonmymachine.substack.com、chiark.greenend.org.uk/~sgtatham、mjg59.dreamwidth.org、tedunangst.com。