第 6 期
今日趋势
今天简报的核心主线之一是AI产品与技术的内部矛盾,尤其是OpenAI在整合ChatGPT、Codex和API时暴露出的技术导向与用户体验之间的冲突,多位评论者指出其产品变得臃肿混乱,而Roblox获准在iOS上推出AI游戏构建工具却引发平台审核双重标准的质疑,进一步凸显了AI落地中的规则不一致性。另一条主线是AI带来的价值转移与稀缺性变化:当实现手段从稀缺变为丰裕,价值重心转向上游的“问题选择”和下游的“分发”,同时Linus Torvalds明确肯定AI作为工具的实用性,而Gwern则提出过度训练可能是通往类人智能的路径,两者对AI潜力的看法形成有趣的分歧。值得关注的共性是,多个条目都在追问AI效率提升是否真正带来了创新,以及如何避免被技术表面的“性感”所迷惑,回归到赚真金白银的朴素商业原则。
AI 技术博客
- OpenAI’s Product Shake-Up Put the Complexifiers in Charge — John Gruber OpenAI将ChatGPT、Codex和API整合为一个核心产品团队,由Codex负责人Thibault Sottiaux领导。作者认为这是错误方向,Codex本身混乱复杂,应由产品思维主导的ChatGPT团队来整合,而非让研究型人员接管。关键结论:这种重组导致ChatGPT变得臃肿和困惑,模仿Claude的复杂结构反而失去清晰度。值得读是因为它揭示了OpenAI产品策略的深层问题,以及技术导向与用户体验之间的冲突。
- Linus Torvalds: ‘AI Is a Tool, Just Like Other Tools We Use. And It’s Clearly a Useful One.’ — John Gruber Linus Torvalds明确表示Linux项目不反对AI,认为AI是有用的工具,质疑其有用性的人显然没用过。他强调AI的实用性已毋庸置疑,尽管经济模式等问题仍待解决。关键结论:Linux不会成为反AI项目,反对者可以选择fork或离开。值得读是因为这是Linux之父对AI的坚定立场,对开源社区和AI行业具有重要参考价值。
- Overtraining as the path to human-like AI — seangoedecke.com 匿名博主Gwern提出通过过度训练使LLM获得类人智能的理论,他早在2020年就预测了规模扩展。关键结论:Gwern认为当前LLM缺乏真正灵活性,而过度训练(grokking)可能是突破路径。尽管该文长达一万三千字且未获广泛关注,但其观点值得深入探讨。值得读是因为Gwern是早期预见LLM潜力的人,他的理论可能指引未来AI发展方向。
- Apple Books and Amazon Are Lousy With AI-Generated Books Ripping Off Legitimate Authors — John Gruber 报道了AI生成的盗版书籍在Apple Books和亚马逊泛滥,作者Joanna Stern和Kashmir Hill都发现自己的书被克隆,封面和标题高度相似。关键数据:Stern在Apple Books上发现至少10本AI克隆书,价格高达20.99美元;Hill的传记在亚马逊上架近一年。尽管苹果曾清理,但问题迅速复发。值得读是因为它揭示了AI对出版业和作者权益的严重威胁,以及平台监管的无力。
- Roblox Set to Introduce AI Game-Building Feature, Including on iOS — John Gruber Roblox宣布推出AI游戏构建工具Build和Studio,允许用户在iOS上创建游戏,计划7月28日测试。关键结论:苹果此前禁止Bitrig、Replit等AI编码应用在iOS上运行,却允许Roblox,引发双重标准质疑。值得读是因为它讨论了平台规则的不一致性及其对创新生态的影响,引发对苹果审核政策的反思。
- MG Siegler: ‘OpenAI Makes ChatGPT ChatGPT Again’ — John Gruber MG Siegler评论OpenAI将ChatGPT改回以聊天为中心,但作者认为问题依然存在:新应用仍臃肿混乱,无法删除聊天只能归档。关键结论:OpenAI似乎不了解用户,决策由研究型人员主导,导致产品方向失误。值得读是因为它深入分析了OpenAI产品迭代中的根本问题,以及用户对简洁体验的渴望。
- OpenAI Starts Cleaning Up the Utter Mess It Made of ChatGPT — John Gruber OpenAI根据反馈改进了新ChatGPT桌面应用,恢复了聊天历史侧边栏和模式切换,并修复了同步问题。但作者批评其仍是1.5GB的Electron怪物,更新过程混乱,旧版升级逻辑令人困惑。关键结论:修复只是表面,根本问题未解决。值得读是因为它展示了OpenAI产品迭代中的技术和管理问题,以及用户对简洁高效工具的期待。
- LLM cliché highlighter — simonwillison.net 介绍一个用于高亮LLM输出中陈词滥调的工具,帮助用户识别AI生成文本中的常见套路和重复模式。核心观点:该工具能提升对AI文本质量的警觉性。值得读是因为它提供了一种实用方法,帮助用户批判性看待AI生成内容。
因果推断与营销科学
- Herman Chernoff — Andrew 本文是作者对统计学家Herman Chernoff的个人回忆,他于103岁去世。作者回顾了在MIT和哈佛与Chernoff的交往,并指出其最重要的贡献是1954年关于似然比分布的论文。文章通过个人视角展现了Chernoff的学术影响和开放探索精神,值得一读。
- Using Classical ML to Empower AI Agents — Stephanie Kirmer 文章强调利用经典机器学习增强AI代理的价值,主张在现有基础上构建。核心观点是传统ML方法仍能为AI代理提供稳定基础,而非完全依赖新范式。值得读是因为它提醒我们不要忽视已有技术的潜力。
- Context Engineering Isn’t Enough — A Loop Engineering Experiment With No LLM Inside the Loop — Emmimal P Alexander 本文介绍了一个无LLM的循环工程实验,用确定性Python基准测试替代模型。实验发现,目标导向控制器能持续完成线性执行器无法到达的分支,证明故障隔离是控制流的可测量属性。值得读是因为它展示了架构本身的价值,独立于LLM推理能力。
- In-House LLM Serving at Netflix — Netflix Technology Blog Netflix自建LLM服务全栈,从模型部署到推理均在内部生产环境完成。架构采用统一JVM服务系统处理路由、特征提取和推理,大型模型通过Model Scoring Service(MSS)在GPU上运行。文章分享了引擎选择、API设计等关键决策及其生产权衡,值得读是因为提供了真实大规模部署的实践经验。
- How to Work Effectively with GPT-5.6 — Eivind Kjosbakken 文章提供最大化利用最新OpenAI模型(GPT-5.6)的方法。核心观点是通过优化提示和交互策略提升效率。值得读是因为它直接针对最新模型给出实用建议。
- Analog AI Is Back, But Can It Survive Its Own Noise? — Ferran Alia 模拟AI因能源危机复兴,本文解释模拟芯片的工作原理及其噪声问题。作者通过模拟噪声实验探讨了模拟计算的生存能力。值得读是因为它深入分析了模拟AI的挑战与前景。
即刻简报
- 发布了: ai 显著降低了制作一个技术对象的成本,功能交付变得更加容易。 当实现手段从稀缺变为丰裕,稀缺性转移到哪了? 上游的「问题选择」和下游的「分发」和… — 即刻·李继刚 本文讨论了AI大幅降低技术对象制作成本后,稀缺性从实现手段转移到上游的“问题选择”和下游的“分发”与“状态改变”。关键结论是:当功能交付变得容易,价值重心转向选择正确问题和高效分发。值得一读,因为它揭示了AI时代价值转移的新方向,对创业者和产品经理有战略启发。
- 发布了: 果不其然,Claude 宣布 Fable 5 将会长期内置在 max 和 team premium 的计划里面,限额是 50%。 估计是由于 OpenAI 和 Kimi K3 的推出的压力带来的,这… — 即刻·歸藏 Claude宣布Fable 5将长期内置在Max和Team Premium计划中,限额50%,PRO及其他会员需通过积分访问,并一次性获得100美元积分。此举被认为受OpenAI和Kimi K3推出压力影响。关键数据是限额50%和100美元积分。值得关注,因为它反映了AI模型定价策略的竞争动态。
- 发布了: 开发好了,QQ2007的Codex主题包 真实可用,创意来自 x @randyloop 目前右侧边栏是静态图片 使用方式也很简单,把评论区的skill安装上,以及黄叔提供的主… — 即刻·AI产品黄叔 开发者发布了QQ2007风格的Codex主题包,真实可用,创意来自@randyloop。使用方式简单:安装指定Skill,下载主题文件,输入提示词即可应用。关键步骤仅两步,且提供了GitHub链接。值得尝试,因为它为Codex用户提供了怀旧且实用的自定义界面方案。
- 发布了: 读《因为独特》里「壁垒和投入产出比」这章,真的心有戚戚。如果没有时间读完整本书,也建议朋友把这一章读一下。 一、关于两倍薪水挖人 这事我作为经理… — 即刻·王紫君Zima 本文分享了《因为独特》中关于“壁垒和投入产出比”的见解,包括两倍薪水挖人、多元化诱惑和内卷现象。关键结论是:壁垒不是跑得快,而是愿意在认定的缝隙里挖十年。值得一读,因为它对创业者和经理人如何构建长期竞争力提供了深刻反思。
- 发布了: AI 在很多事情上都带来了效率提升,让做事情变快了。比如写代码、写文章、画图、做 PPT 等等。 在效率这件事情上,AI 很像手机摄像头。手机让拍照,比用… — 即刻·玉伯 本文类比AI效率提升与手机拍照,指出大量用户消费AI但生成的新东西很少,Skills和Agents并非真正创新。关键问题是:AI生成的新东西在哪?目前无人知晓。值得思考,因为它挑战了AI应用领域的共识,引导读者寻找真正的创新方向。
- 发布了: Fable 5 今天正式确定永久会包含在 Max 计划中 如果我们站在多年以后的未来看向现在 Fable 5 不过是智能发展史上的一粒普通的尘埃 只是 A 社实在太抓马… — 即刻·AGENT橘 Fable 5正式确定永久包含在Max计划中,作者认为这只是智能发展史上的一粒尘埃,大模型是人类集体智慧的产物,无需焦虑。关键观点:没有独家秘籍,不必过度担忧技术垄断。值得一读,因为它以平和视角缓解了AI技术焦虑。
- 发布了: 泡泡玛特和茅台一样是没有什么竞争对手的。投资者和老板知道这意味着什么,特别是看到王宁对中国式内卷的描述,更是心有戚戚。 前段时间看到 spencer 说… — 即刻·王紫君Zima 本文指出泡泡玛特像茅台一样缺乏竞争对手,投资者讨论的是骗局而非竞争,与比亚迪、小米等评论区形成对比。关键现象:泡泡玛特评论区无人讨论竞争。值得一读,因为它揭示了独特商业模式带来的市场认知差异。
- 发布了: 芒格生前有一句话,反反复复说了一辈子: “It wasn’t a good business just because it was doing sexy things. If it wasn’t earning real cash, or wa… — 即刻·王紫君Zima 本文引用芒格名言:好生意必须赚真金白银,不能因“性感”而成为好生意。作者强调投资应为未来现金流买单,而非为老板或愿景。关键结论:短期看不到赚钱希望就不是好生意。值得一读,因为它提供了朴素而坚实的投资原则。
本期有 8 个源不可用:lcamtuf.substack.com、garymarcus.substack.com、rachelbythebay.com、joanwestenberg.com、dfarq.homeip.net、gwern.net、worksonmymachine.substack.com、tedunangst.com。