第 18 期
今日趋势
今天AI领域呈现两条主线:一是从“无所不能”的炒作转向“实用至上”的务实态度,多位作者强调生成速度、成本控制和产品价值主张才是关键,甚至有人直言“一句话能说清的AI产品基本已死”;二是行业内部治理与职场文化的隐忧,企业一边说谎夸大AI影响,一边在定价上维持高毛利,而学术界和职场中则存在欺诈、功劳归属不公等潜规则。值得关注的是,OpenAI的Astra模型以极低成本解决数学难题,与普通用户对AI认知低、使用率低的现实形成鲜明反差,折射出前沿技术与大众应用之间的巨大鸿沟。
AI 技术博客
- Pluralistic: Why businesses lie about AI (01 Aug 2026) — Cory Doctorow 本文剖析了企业为何在AI上撒谎,指出CEO们声称AI改变一切,但证据薄弱。关键结论是:即使关闭所有聊天机器人,国家运转不受影响,而关闭Office 365或手机则会瘫痪。文章值得读,因为它揭露了数字主权的真正危机,并提醒读者警惕AI炒作的泡沫。
- I’m (mostly) picking models on speed now, not intelligence — martin@martinalderson.com (Martin Alderson) 作者分享了自己选择AI模型时从追求智能转向追求速度的体验,认为Opus 4.6级别已足够日常任务。关键数据是:100 token/s的生成速度让人感觉“即时”,而慢模型会破坏使用体验。本文值得读,因为它揭示了AI实用化的新标准,并强调速度对用户满意度的重要性。
- Quoting Greg Brockman — simonwillison.net 本条引用了Greg Brockman的言论,但未提供具体内容。虽然信息有限,但Brockman作为OpenAI联合创始人,其言论常具影响力。值得关注其后续完整引述,以了解AI领域的最新观点。
- Open letters about AI development — simonwillison.net 本条是关于AI发展的公开信,但未提供具体内容。公开信通常反映行业共识或争议,值得了解各方立场。建议读者查阅相关公开信原文,以把握AI治理的动向。
- datasette-apps 0.2a0 — simonwillison.net 本条目宣布datasette-apps 0.2a0版本发布。具体更新内容未详述,但版本号暗示可能包含新特性或修复。对于datasette用户,值得关注更新日志以获取详细改进。
- July 2026 newsletter — simonwillison.net 本条目是2026年7月的新闻简报。未提供具体内容,但通常涵盖当月重要事件。读者可订阅以获取定期更新,了解科技与社会的动态。
- Ten advances in mathematics and theoretical computer science — simonwillison.net 本条目列举了数学和理论计算机科学的十项进展。未提供具体列表,但此类总结常具启发性。适合对基础科学感兴趣的读者查阅,以拓展思维边界。
- Giving and taking credit in big tech companies — seangoedecke.com 本文探讨了大科技公司中的功劳归属问题,指出工程师需主动争取认可,因为经理无法直接评估技术绩效。关键结论是:默默帮助项目可能反而被惩罚,功劳与努力不相关。文章值得读,因为它揭示了职场潜规则,帮助新人避免“学校幻想”。
因果推断与营销科学
- Why quantitative understanding of effect sizes matters, even if all you care about is the presence of the effect — Andrew 本文讨论效果量(effect size)的重要性,即使研究者只关心效应是否存在。作者通过对话反驳了’欺诈者会刻意低调以免被发现’的观点,指出像Wansink、Gino等知名学术欺诈者反而高调行事,因为欺诈曾让他们获得长期成功。关键结论:仅审计热门论文可能遗漏欺诈,但分散注意力的低质量论文危害较小。值得一读,因为它揭示了学术欺诈动机与审查策略之间的微妙关系。
- Coding Agents Don’t Need Bigger Context Windows — They Need a Context Compiler — Emmimal P Alexander 本文指出当前编码代理(coding agents)通过增加上下文窗口来提升性能,但这种方法会导致无关代码干扰和模型’记忆压缩’,实际表现为上下文退化。作者提出类似编译器的’上下文编译器’,能智能决定保留、精简或丢弃哪些代码片段。关键结论:更好的上下文管理比单纯扩大窗口更有效。值得一读,因为它提供了提升编码代理效率的新思路,避免陷入规模陷阱。
- Put the Agent Inside the Workflow — Shuai Guo 本文介绍一种混合LLM应用模式:将预定义工作流与自适应智能体行为相结合。该模式先由预设流程处理标准步骤,再让智能体在复杂或异常情况下灵活决策。关键结论:这种混合架构在保持可靠性的同时提升了适应性,适用于需要平衡效率与灵活性的场景。值得一读,因为它为LLM的工程落地提供了实用且可扩展的设计模式。
即刻简报
- 发布了: OpenAI 感觉翻身了啊,已经在预热他们的下一代模型Astra。 他们用这个模型解决了 10 个至少存在了十年的数学问题。 这些问题如果是数学家解决的话,感觉… — 即刻·歸藏 OpenAI预热下一代模型Astra,成功解决了10个存在至少十年的数学难题,算力成本仅2000美元。Sam Altman亲自赴华盛顿沟通发布事宜,暗示该模型可能极为强大。本文值得关注,因为它展示了AI在数学领域的突破性进展和极低的成本,预示AI能力的新高度。
- 发布了: 自媒体博主到Agent社群:7月只发了1条广告 复盘下7月:黄叔自己的核心业务逐渐迁移到Agent社群了 目前仍然主要在北京 7月份尽管中间带娃暑假休息了10天 … — 即刻·AI产品黄叔 作者复盘7月业务转型,从自媒体广告转向Agent社群,7月仅发1条广告但社群销售近200份,日Token消耗突破200亿。8月目标营收翻倍,计划通过精品视频教程、直播和分销实现。值得一读,因为它提供了从自媒体到AI社群转型的实操经验和增长策略。
- 发布了: AI 时代做产品 切忌一句话能说清楚 — 即刻·玉伯 玉伯指出,一句话能说清楚的AI产品基本已死。AI时代产品需要更复杂的价值主张。本文简短但观点犀利,适合产品经理和创业者反思产品定位。
- 发布了: AI 真的太贵了 本文所述内容均来源于真实事件,但隐去具体名称实属无奈之举,并非故意制造阅读障碍,还望大家理解。 AI 行业有个吊诡的事儿我一直想不明… — 即刻·AGENT橘 文章揭露国内AI模型套餐价格昂贵,用户很快用完额度,而海外同类套餐更耐用。通过成本分析发现模型厂商毛利率高达90%,降价后仍有50%毛利,堪比茅台。作者认为高价格阻碍了AI应用层发展,呼吁降价以促进生态。值得一读,因为它深入剖析了AI定价逻辑和行业困境。
- 发布了: 天天给不同企业做AI培训,不得不感慨普通人(非先进科技从业的青壮年办公室职工人群)对AI的整体认知水平还是很低的,几乎不用。 但有意思的是,这并不… — 即刻·陶晨毅_再减15斤 作者发现普通人对AI认知水平低,几乎不用,但核心原因是缺乏学习意愿和工具。一旦提供AI工具和培训,使用深度与主动接触者差别不大。本文值得一读,因为它打破了“早期采用者优势”的迷思,强调工具普及的重要性。
- 发布了: 发现自己的粉丝还在持续上涨。分享下做 Founder IP 最核心的三个方法: 1、勤奋是基础。最好坚持日更。如果做不到,也至少得一周五次。这是最最重要的一… — 即刻·玉伯 作者分享做Founder IP的核心方法:坚持日更或一周五次;在勤奋基础上寻找独特性,如敢于直言;通过精选信息源保存注意力。强调亲自下场,不假手他人。适合想打造个人IP的创业者参考。
- 发布了: 几乎每次培训都会有投影和麦克风扩音器和网络问题,话说酒店会场和公司大会议室不是专门做这件事的么,怎么总有问题🙃 — 即刻·陶晨毅_再减15斤 作者吐槽每次培训都会遇到投影、麦克风和网络问题,质疑专业会场为何总出故障。简短吐槽,反映常见痛点。
- 一觉醒来世界发生了什么 2025年地方养老基金投资收益率为5.76%|界面新闻 · 快讯 — 即刻·即刻资讯台 据界面新闻快讯,2025年地方养老基金投资收益率为5.76%。这一数据反映了养老基金的运营状况。值得关注,因为它关乎养老金保值增值和民生保障。
本期有 9 个源不可用:lcamtuf.substack.com、garymarcus.substack.com、rachelbythebay.com、joanwestenberg.com、dfarq.homeip.net、gwern.net、worksonmymachine.substack.com、chiark.greenend.org.uk/~sgtatham、tedunangst.com。