第 8 期
今日趋势
今天简报的两条主线清晰浮现:一是AI应用商业化正面临严峻的算力与成本瓶颈,Kimi因算力紧缺暂停会员销售、GLM定价高昂且agentic能力未达预期,而国产模型如Qwen 3.8的突破传闻则让中美差距缩短至三个月成为焦点;二是技术工具与设计原则的持续优化,从正则表达式压缩、设计即代码的Paper工具,到公共交通票务的“别让我思考”原则,再到因果推断中严谨的偏差控制方法,均体现出对效率与用户体验的极致追求。值得关注的共性在于,无论AI还是传统技术领域,都在试图降低认知负担与资源消耗,而分歧则体现在AI商业化中成本与性能的尖锐矛盾,以及“先做个垃圾出来”这一旧有方法论在AI执行力拉满后的失效——低质量内容泛滥迫使行业回归深度思考。
AI 技术博客
- Quoting Sam Altman — simonwillison.net 本条为Sam Altman的引述,未提供具体内容。作为OpenAI CEO,其言论常涉及AI发展、政策或行业趋势。值得关注以了解前沿观点。
- Fitting a regular expression to a list of words — John 本文介绍如何将单词列表合并为紧凑的正则表达式,利用trie结构优化匹配效率。关键结论:Python的trieregex库通过公共前缀生成更短的正则,避免暴力枚举。值得读:提升文本搜索性能,减少正则表达式体积。
- Paper — John Gruber 本文介绍Paper设计工具,其每层均为真实HTML/CSS,支持双向转换(代码到设计、设计到代码),并可连接AI代理。关键结论:设计即代码,减少交接和抽象层。值得读:了解如何用新工具简化设计到开发流程。
- 9to5Mac Uncovers Dozens of Disguised Gambling Apps on the App Store in Brazil — John Gruber 9to5Mac调查发现巴西App Store中超过60款伪装成导航、天气等类别的赌博应用,其中“PotatoPlot Puzzle”竟成第一天气应用。关键结论:这些应用在巴西IP下显示赌博平台,审核未能识别。值得读:揭示App Store审核漏洞,强调需打击成功诈骗而非追求零风险。
- Public Transport - Don’t Make Me Think! — @edent 本文对比多城市公共交通票务体验,强调“别让我思考”的设计原则。关键结论:巴塞尔免费交通卡最理想(零操作),米兰接触式刷卡次之(统一流程)。值得读:从用户认知负担角度分析票务系统优劣,为设计提供参考。
- Sum of low squares — John 本文介绍素数p(≡3 mod 4)的低平方和签名,该签名可唯一确定p。关键结论:签名s对应的p是16s+1的最大素因子,且可通过特定分母快速计算。值得读:展示数论中简洁的逆映射技巧,适合数学爱好者。
- Memory Safety’s Hardest Problem — Alex Kladov 本文讨论内存安全中最难的类型混淆问题,通过联合体取指针后修改类型实现。关键结论:实际中缓冲区溢出更易利用且易修复,行业应重视Walter Bright的数组语法建议。值得读:理解内存安全核心挑战及被忽视的解决方案。
- OpenTK: nu ook met Internetconsultaties & notificaties — berthub.eu 本文介绍OpenTK项目,旨在透明展示荷兰议会动态并提供邮件通知。关键结论:项目始于作者对DNS相关立法的惊讶,现新增互联网咨询功能。值得读:了解如何用技术提升政治参与和信息公开。
因果推断与营销科学
- Frugal, Flexible, Faithful: Causal Data Simulation via Frengression — Linying Yang, Jens Magelund Tarp, Robin J. Evans, Xinwei Shen 本文提出frengression,一种基于深度生成模型的因果数据模拟方法,通过节俭参数化联合建模协变量、处理变量和结果变量的分布。关键结论是该方法能准确估计并灵活模拟多变量、时变数据,支持从用户指定的干预分布直接采样,在真实临床试验数据上验证了实用性。值得一读,因为它为因果边际建模的生成方法开辟了新研究方向。
- Learning What to Learn: Experimental Design when Combining Experimental with Observational Evidence — Aristotelis Epanomeritakis, Davide Viviano 本文针对实验与观测证据结合时的实验设计问题,提出统一框架,在预算约束下选择实验并分配样本量。关键结论是采用极小化极大比例遗憾准则评估设计,无需指定偏差界限,仅依赖常规功效计算所需信息,实现透明的偏差-方差权衡。值得一读,因为它为政策评估中结合实验和观测数据提供了严谨的设计工具。
- Learning What to Learn: Experimental Design when Combining Experimental with Observational Evidence — Aristotelis Epanomeritakis, Davide Viviano 本文针对实验与观测证据结合时的实验设计问题,提出统一框架,在预算约束下选择实验并分配样本量。关键结论是采用极小化极大比例遗憾准则评估设计,无需指定偏差界限,仅依赖常规功效计算所需信息,实现透明的偏差-方差权衡。值得一读,因为它为政策评估中结合实验和观测数据提供了严谨的设计工具。
- Improving Mendelian Randomization Analysis by Instrument Borrowing from Auxiliary Outcome Traits — Anagh Chattopadhyay, Nilanjan Chatterjee 本文提出工具借用(IB)方法,利用辅助结果性状改进孟德尔随机化分析。关键结论是引入共异质性统计量识别共享有效工具变量的性状,扩展MR-Mode和MR-PRESSO后,模拟显示IB方法在有效工具重叠度增加时显著优于标准方法,并在维生素D与心脏代谢性状的因果效应中验证了实用性。值得一读,因为它为存在无效工具时提供更稳健的因果推断。
- B-CALM: Bias-Limited Bayesian Borrowing for RCT-Anchored Treatment Effects under Covariate Mismatch — Amir Asiaee, Samhita Pal 本文提出B-CALM方法,用于在协变量不匹配下进行贝叶斯借用,估计RCT定义的条件平均处理效应。关键结论是使用基线偏差和比较偏差函数建模观测数据偏离,证明有限特征偏差限制信息界,并推导有效样本量公式,在合成和真实数据中保持近名义覆盖和低负迁移。值得一读,因为它为结合RCT和观测数据提供了严格的偏差控制框架。
- Cluster-Aware Matching via Laplacian Optimal Transport — Gabriel Samberg, YoonHaeng Hur, Yuehaw Khoo, Nir Sharon 本文提出基于拉普拉斯最优传输(LapOT)的聚类感知匹配方法,通过二次拉普拉斯正则化鼓励耦合尊重点云的聚类结构。关键结论是引入精炼同步聚类(RSC)方法利用聚类感知耦合产生一致分区,克服独立聚类局限,理论和实验证明LapOT产生更一致和有意义的对齐。值得一读,因为它为具有内在聚类结构的点云匹配提供了稳健的区域对齐方案。
即刻简报
- 发布了: 基于 Claude 或 GPT 做 AI 应用,营收不错。然而一旦减去 tokens API 费用,就让人绝望。 GLM 5.2 让人看到了希望。然而,定价依旧很高,agentic 能力上… — 即刻·玉伯 本文分析了当前AI应用在扣除API费用后盈利困难的问题,指出GLM 5.2虽在agentic能力上接近Sonnet 4.5,但定价高昂且K3服务不可用,并未带来商业替换价值。作者期待DeepSeek V4正式版,认为若其性能超越GLM 5.2且价格不变,将成为国产AI的突破。值得一读,因为它揭示了AI API成本对应用商业化的真实影响,并提供了对国产模型竞争格局的深度洞察。
- 转发了: Kimi 宣布因为算力紧缺,暂停 C 端会员的销售,果然没卡了。 — 即刻·歸藏 Kimi因算力紧缺宣布暂停C端会员销售,证实了其算力不足的现状。转发者建议用户尽快购买Token Plan以应对资源紧张。核心观点是算力瓶颈直接影响了AI服务的供给策略。值得关注,因为它反映了当前AI行业算力稀缺的现实,对用户选择服务有直接参考价值。
- 发布了: 以前有句名言叫【先做个垃圾出来】 它是为了劝说那些思考太多执行不够的人,先做一个版本扔出去,得到真实反馈再迭代。 而今年以来 AI 已经把执行力拉满… — 即刻·AGENT橘 文章反思了“先做个垃圾出来”这句名言在AI时代的失效。过去这句话鼓励行动,但如今AI大幅提升了执行力,导致低质量内容泛滥。作者提出新语境下需要更多思考,不要轻易输出垃圾。值得一读,因为它切中了AI产品泛滥的痛点,提醒创作者回归质量与深度。
- 发布了: 如果 Qwen 3.8 真的超越了 GPT 5.6 那中国模型和美国模型的差距就缩短到了 3 个月 阿里这次这么猛吗? 晚上用用看 hhh — 即刻·AGENT橘 作者听闻Qwen 3.8可能超越GPT 5.6,认为若属实,中美模型差距将缩短至3个月,对阿里的进展表示惊讶和期待。核心观点是国产模型进步迅速,有望缩小与国际顶尖水平的差距。值得关注,因为它传递了AI领域竞争格局变化的重要信号。
- 发布了: 马斯克在Zip2时期做过一件事,现在看来几乎是他整个商业策略最早的原型。 他们把公司那台小电脑,塞进了一个超大的机箱框架里——机箱又高又宽,看起来… — 即刻·王紫君Zima 本文讲述了马斯克在Zip2时期用大机箱装小电脑欺骗投资人,以及2009年用改装Smart原型车打动戴姆勒获得5000万美元投资的故事。关键结论是马斯克深谙人对直接感受的判断远快于对抽象理解,因此用实物体验代替PPT说服。值得一读,因为它揭示了马斯克商业策略的核心原型,对创业者和产品经理有启发。
- 发布了: 此时,冠军西班牙就成了我的瓦格纳。 现代足球导致的,我们过去熟悉的一切元素消失,犀利的边路突破,中场核心的独舞,孤胆英雄直捣黄龙,高大中锋在小… — 即刻·老编辑 文章以西班牙足球队为例,批判现代足球因强调合理传导而消灭了边路突破、孤胆英雄等传统元素,导致足球精神陷入虚无。核心观点是效率至上的现代性正在抹杀个性与激情。值得一读,因为它用足球隐喻了现代性对人文精神的侵蚀,引发对技术与传统平衡的思考。
- 发布了: 今天见两个合作伙伴,路上分享一下我写的这个文章,因为它回答了一个我被问了很多次的问题: “香港金融不是全球顶尖吗?为什么我体验这么差?” 先说结论… — 即刻·王紫君Zima 本文解答了“香港金融全球顶尖但个人体验差”的疑问,指出体系顶级(银行业、保险业全球第一)但服务者立场不同。作者对比了银行客户经理(只能卖自家产品)与持牌经纪行(中立推荐)的区别,强调后者能提供三层保障。值得一读,因为它为内地客户提供了香港开户、保险配置的避坑指南,实用性强。
- 发布了: 在文明的高地,哲学的故乡,再震撼一下恐烟的拳师。 全世界没有你们的容身之处了。下回准备死给谁看呢,白老爷也不看啊! — 即刻·老编辑 作者以激烈言辞抨击“恐烟的拳师”,认为他们在文明高地和哲学故乡没有容身之处,并讽刺其抗议行为无人关注。核心观点是反对过度恐烟,认为这种情绪在全球不受欢迎。值得一读,因为它反映了网络争论中的极端立场,但内容较短,提炼观点即可。
本期有 8 个源不可用:lcamtuf.substack.com、garymarcus.substack.com、rachelbythebay.com、joanwestenberg.com、dfarq.homeip.net、gwern.net、worksonmymachine.substack.com、tedunangst.com。