第 33 期
今日趋势
今天的内容可归纳为两大核心主线,一是AI领域的多元动态,既包含对Anthropic水印计划的伦理批判、开源模型指令遵循问题的反思,也涉及芯片供应链的国际博弈、AI工具的使用体验与行业人物背景披露,展现了AI技术发展中伦理边界、实用优化与产业竞争的多重维度。二是因果推断与营销科学的学术研究进展,多篇论文围绕随机实验设计、多中心试验分析、半监督数据处理及面板数据预测等方向展开,为相关领域的实践提供了关键的理论支撑与方法优化。此外,即刻简报类内容则涵盖了AI服务消费的实用调整、会员订阅优惠、消费维权提醒及趣味分享等,兼具实用参考价值与轻松趣味性,其中DeepSeek涨价对订阅方案的影响分析,也为AI服务消费者提供了明确的决策依据。
AI 技术博客
- ★ Anthropic’s ‘Watermark’ Text Adulteration in Claude Is a Perversion of Writing — John Gruber 本文针对Anthropic宣布为所有Claude模型生成内容加水印的计划展开批判,作者原本猜测水印是隐形字符,实际是通过语义选择的隐写技术,还指出Anthropic原声称水印不改变文本质量的说法存在矛盾。文章揭露了该计划违背写作本质的问题,值得关注AI生成内容溯源的伦理边界。
- Qwen 3.8 27B is excellent, but it defaults to wildly overthinking things — simonwillison.net Qwen 3.8 27B开源大模型性能出色,但存在默认过度思考的问题,即过度解读用户输入导致输出偏离真实需求,影响使用体验。这一问题反映了开源模型在指令遵循上的不足,值得开发者关注优化方向。
- ‘Anthropic’s Weak Watermarks Appease a Weak Law’ — John Gruber James Padolsey批评欧盟AI溯源法的边界不合理,Anthropic的Claude水印实现范围超法律要求,既牵连无害使用又易被破解,他开发的Declaude工具可清除Claude水印,还解释了水印原理。文章批判了AI水印的合规漏洞,提供了实用工具,值得了解AI溯源的现实困境。
- Oops, Should’ve Thought of That — blog.jim-nielsen.com Gordon Brander提出,LLM能理解用户意图,不像旧电脑只执行精确指令,未来会出现更多“意外”情况,专业人士需预判LLM的非预期后果,业余人士难以做到。日常软件需减少这类问题,文章点明了LLM时代的软件开发核心挑战,值得从业者参考。
- Quoting Dario Amodei — simonwillison.net 本条是对Anthropic创始人Dario Amodei观点的引用,虽未公开具体内容,但关联AI领域核心人物的发声,涉及AI发展的关键方向,值得关注AI行业的核心动态。
- The Information Profiles Cami Clark — Dario Amodei’s Wife, Ivanka Trump’s Friend, One-Time Would-Be Pornographer, and Anthropic’s ‘First Lady’ — John Gruber The Information披露,Cami Clark是Anthropic创始人Dario Amodei的妻子,曾尝试创办色情公司并联系过Jeffrey Epstein,她是Anthropic的幕后关键人物,未担任正式职务。文章揭露了AI行业核心人物的背景细节,值得了解AI创业圈的隐秘关系。
- Markdown SVG upgrades — simonwillison.net 本条涉及Markdown与SVG结合的升级内容,虽未公开具体细节,但属于前端技术工具的优化方向,关联文档格式与图形展示的融合,值得关注技术工具的更新趋势。
- Trump Administration ‘Not in Favor’ of Apple Using Chinese RAM — John Gruber 美国苹果公司考虑用中国芯片厂商的RAM缓解供应短缺,但特朗普政府反对,要求美国公司不用中国内存,美国规则需许可才能向中国芯片商提供信息,苹果称要考虑所有选项。文章披露了美中科技供应链的博弈,值得关注全球芯片产业的竞争格局。
因果推断与营销科学
- Sharp Minimax Theory for Randomized Experiments — Timothy Sudijono, Edgar Dobriban, Eric Tchetgen Tchetgen 本研究针对有限总体随机实验中样本平均处理效应的极小极大最优设计与估计量展开研究,在二元潜在结果下,明确极小极大风险等价于两未知参数估计问题的风险,推导了含Airy函数相关常数的二阶风险展开式,最优风险可通过伯努利随机化结合非线性收缩估计量实现。研究指出标准方法仅在一阶n阶下达到极小极大最优,为实验设计和估计提供了理论依据,具有重要学术价值。
- Robust Covariate Adjustment in Multi-Center Randomized Trials — Muluneh Alene, Stijn Vansteelandt, Kelly Van Lancker 本研究聚焦多中心随机试验中常用协变量调整方法的缺陷,发现忽略中心聚类会损害估计精度、降低置信区间覆盖率,尤其影响反事实均值估计。提出考虑中心效应的半参数有效估计量与适配多小中心的推断框架,模拟及WASH Benefits试验数据验证了方法的良好性能。该研究解决了多中心试验分析的关键问题,提升了估计可靠性,对多中心试验实践有指导意义。
- Sharp Minimax Theory for Randomized Experiments — Timothy Sudijono, Edgar Dobriban, Eric Tchetgen Tchetgen 本研究针对有限总体随机实验中样本平均处理效应的极小极大最优设计与估计量展开研究,在二元潜在结果下,明确极小极大风险等价于两未知参数估计问题的风险,推导了含Airy函数相关常数的二阶风险展开式,最优风险可通过伯努利随机化结合非线性收缩估计量实现。研究指出标准方法仅在一阶n阶下达到极小极大最优,为实验设计和估计提供了理论依据,具有重要学术价值。
- Semi-supervised Concordance Learning for Optimal Individual Treatment Regimes — Mengjiao Peng, Yong Zhou, Wenbin Lu 本研究针对半监督数据下最优个体化治疗规则的估计问题,这类数据仅少量观测有结果标签,大部分无。提出半参数推断方法,结合单索引核平滑插补与一致性辅助学习,证明估计量的一致性与渐近正态性,模拟及MIMIC-III等数据显示方法比全监督方法更高效稳健。该方法填补了半监督场景下个体化治疗规则估计的空白,适合医疗数据等标签不足的场景,应用价值突出。
- Assessing Vaccine Effectiveness in Observational Studies via Nested Trial Emulation — Justin B. DeMonte, Bonnie E. Shook-Sa, Michael G. Hudgens 本研究利用嵌套试验模拟法评估观察性数据中的疫苗有效性,可处理疫苗有效性随日历时间、接种后时间变化的问题,提出逆概率加权估计量,标准化试验间协变量差异并检验有效性异质性,在意大利11万多居民数据中得到应用。该方法减少了观察性研究的偏差,为真实世界疫苗有效性评估提供了可靠框架,对疫苗政策制定有重要帮助。
- Causal Forecasting in Panel Data: A Two-Way Synthetic Forecasting Approach — Dennis Shen 本研究针对面板数据的因果预测问题,现有方法多为回顾性,而决策者常需前瞻性预测,结合合成控制法与时间序列预测框架,提出双向合成预测估计量,理论上证明了有限样本误差界与渐近性质,模拟及NFL体育场案例验证了有效性。该方法填补了面板数据因果预测的空白,支持前瞻性政策评估,具有重要实践意义。
即刻简报
- 发布了: 昨天把马斯克的福利薅了后 开始用Cursor的Fable 5规划 Grok 4.6开发 完成了一版TokenStep统计本地Token消耗量的软件升级 浮窗改成了横版 增加了Cursor/G… — 即刻·AI产品黄叔 本条分享了作者近期的AI工具使用动态,包括薅取马斯克相关福利后,用Cursor的Fable5规划Grok4.6开发,完成了本地Token消耗量统计软件TokenStep的升级,将浮窗改为横版并增加了Cursor、Grok的用量统计。作者指出Grok4.6在开发细节上逊于GPT5.6,但Cursor、SuperGrok的用量十分惊人。这条内容能让AI开发者了解相关工具的使用体验与升级情况,有实用参考价值。
- 发布了: DeepSeek 涨价事件对 Cola Token Plan 的影响: 1.很不幸,DeepSeek 在用低价打完市场之后,选择了大幅涨价,缓存部分涨幅超过 12 倍,综合涨幅在 3-6倍… — 即刻·AGENT橘 本条分析了DeepSeek大幅涨价对Cola Token Plan的影响,DeepSeek涨价后其缓存部分涨幅超12倍,综合涨幅达3-6倍,Cola因此调整了模型方案,调整后整体成本约为之前的3倍。调整后Flash模型仍具高性价比,Lite与Basic模型价格接近、能力相近,Lite中文写作更优,且Cola正设计新方案保障用户权益。这条能让订阅Cola Token Plan的用户了解价格变动及选择建议,有实用指导意义。
- 发布了: 卧槽,原来现在还是能以每个月 99 美元的价格,订阅 Grok Harvey 这个级别的会员,这个超值! 你相当于一下获得了: 1. 价值 300 美元的 Grok Harvey(… — 即刻·歸藏 本条分享了超值的AI会员订阅信息,用户可每月99美元订阅Grok Harvey级别会员,该会员包含价值超700美元的多项权益,如Grok Harvey、Cursor Ultra会员、Grok Bot额度、图像视频模型额度及Twitter Premium+订阅。作者还详细说明了订阅的操作路径及需注意的取消订阅事项,避免后续按高价续费。这条能让AI爱好者获取高性价比的会员订阅渠道,有实用价值。
- 发布了: 我去!这个太有意思了。 谁不想在等 AI 完成任务的时候玩上一把德州并且把自己的 Token 输光呢 — 即刻·歸藏 本条是一条趣味分享,作者调侃等AI完成任务时玩德州游戏,结果把自己的Token都输光了,内容简短幽默,体现了AI使用间隙的趣味场景。这条内容轻松有趣,能让读者感受到AI使用中的小趣事,适合放松阅读。
- 发布了: 第11集有些文过饰非了,20年间改革的主要成本,是他们支付的。 直到2012年之后开始扭转。 — 即刻·老编辑 本条针对某第11集内容提出批评,认为其存在文过饰非的问题,指出20年间某改革的主要成本由特定群体支付,直到2012年后才开始扭转这一状况。这条内容对相关剧集的观点提出了不同看法,能引发读者对改革成本承担问题的思考,有讨论价值。
- 发布了: 听@杨一 转述他上次参加D23时听到皮克斯首席创意官Pete Docter的金句:“做内容就像送礼物,你最终是要送给对方礼物,因此一定要考虑用户的感受,但是它… — 即刻·kyth 本条转述了皮克斯首席创意官Pete Docter的金句,他认为做内容就像送礼物,既要考虑用户的感受,又要融入自己的心意,是内容创作的核心准则。这条金句能为内容创作者提供创作思路,帮助平衡用户需求与个人表达,有启发意义。
- 一觉醒来世界发生了什么 赵一鸣好想来零食店陷称重争议,遇到“缺斤短两”怎么办?_澎湃质量观_澎湃新闻-The Paper — 即刻·即刻资讯台 本条标题提及赵一鸣好想来零食店的称重争议,探讨遇到缺斤短两该怎么办,但正文无具体内容,仅为相关话题的预告。这条内容引出了零食店称重争议的话题,能引发读者对消费维权问题的关注,有讨论空间。
- 发布了: 如有巧合,请勿对号入座哈。这个是我道听途说的。 就是最早呢,有一批在香港做钱庄的,他们都是西南甘肃这边的穆斯林。这些穆斯林他们都姓 M。 他们一个… — 即刻·王紫君Zima 本条分享了道听途说的信息,称香港有一批来自西南甘肃的穆斯林(姓M),早年做钱庄生意,转型后从事支票、转账诈骗,还涉及200万香港信息差骗局,提醒注意相关诈骗风险。这条内容揭露了特定诈骗群体的转型情况,能帮助读者提高对相关诈骗的警惕性,有警示作用。
本期有 10 个源不可用:lcamtuf.substack.com、garymarcus.substack.com、rachelbythebay.com、joanwestenberg.com、dfarq.homeip.net、gwern.net、worksonmymachine.substack.com、chiark.greenend.org.uk/~sgtatham、anildash.com、tedunangst.com。