AI最新动态|2026-09-30
本期汇总了14 位 AI 建造者的 32 条动态、1 篇官方博客,提炼值得关注的产品进展、工程实践与行业变化。
本期速览
OpenAI DevDay 成为过去 24 小时讨论的中心。Sam Altman 宣布 Dots 上线,将其描述为一种“7×24 小时为你工作”的 AI 使用方式,目标是让用户把时间与注意力收回到更高层级的工作上。他还提到 Ultrafast 的速度体验,以及 Sol 6.1 的定价:价格为 Astra 的五分之一,缓存读取折扣达 95%。Thibault Sottiaux 补充说,几天内会有数百万个 Dots 上线,覆盖庞大而多样的社区;他个人在使用两三天、教会它更多偏好后感受到明显跃升,并称其能快速学习、独立承担“令人意外的雄心任务”。团队会先观察用户如何使用“主 dot”,再释放创建整支 dot 团队的能力。
围绕 DevDay 的现场氛围,Peter Yang 表示自己几乎没听分会场,主要时间用于见人,并逐一点名同行;Dan Shipper 则为 Every 的 DevDay 报道造势,包括两份 vibe check、直播、实时 feed 以及即将发布的与 Altman 的播客。Swyx 提到在 gateway pavilion 收集社区关于 Dots、Sol 6.1、CUA 和 Decisions API 的问题。
X 上的关键观点
模型与产品发布。 Altman 的三条推文构成事实层面的发布信息:Dots 上线、Ultrafast 提速、Sol 6.1 定价与缓存折扣。Sottiaux 的表述更偏产品观察与预期,属于个人判断与官方预告的混合。Thariq 借 Claude 提速的博客发文,并给出一个被大量转发的提示词建议——“我们有能力做任何事,请更勇敢一点”,这条更接近使用技巧而非产品公告。
工程与成本。 Amjad Masad 分享如何设计并构建 harness,以一小部分成本达到前沿性能,指向“工程封装”而非单纯堆模型能力的路径。Guillermo Rauch 宣布 AI SDK 周下载量达到 3000 万,并演示用 fframes 加相关工具一次性生成视频,强调视频由 Rust 编写、GPU 渲染。Garry Tan 称已将 OpenClaw 的 test-audit skill 合并进 GStack,理由是测试膨胀是真实问题。
创业与市场情绪。 Nikunj Kothari 提出两点判断:一是“传教士”越来越难找,联合创始人、上市公司 CEO、创始人都在快速流向“显而易见的赢家”,早期投资人下注的人可能随时离开,留下空壳;二是护城河不再是单一事物,尤其在应用层,harness 是上千件小事的集合,且很多不可见,需要深入细节才能分辨产品、技术与 GTM 的复合优势。这属于他的个人观点,而非行业共识。他还给出一个增长技巧:把 X 上的热门内容聚合后发到 LinkedIn,因为后者通常慢一两周。
安全与标准。 Aaron Levie 认为,AI 行业在可预见未来完全可以通过一套共享标准与实践来处理安全与安保问题;随着能力推进,更严格的监督、测试、责任层与监管终将到来,但当前阶段行业仍能集体对齐,且不必牺牲竞争。这是明确的观点表达。
其他。 Zara Zhang 称用 Opus 5.5 经 6 个提示词做出一个水瓶营销网站,并调用 ElevenLabs、Meshy 与 OpenAI API 生成音乐、3D 资产与图片。Peter Yang 还提到 YouTube 上屏蔽 AI 短视频的开关,并建议让用户或家长彻底选择退出 shorts。Rauchg 另发一条关于产品缺陷与下载量负相关的图表。
官方博客更新
Claude 博客发布《Claude in Chrome is generally available》。要点:Claude in Chrome 已在所有付费 Claude 套餐中正式可用,并能自主执行浏览器操作,不再需要逐步批准;每个动作在执行前由安全分类器校验,确认安全且符合用户请求。博客说明该能力可接入内部仪表盘、遗留系统和供应商门户等未与 Claude 集成的工具,可读取当前页面、输入文本、点击链接、跨页导航和填表,并使用用户已有登录态。
针对提示注入,博客给出三层防护:用不断扩充的攻击库训练模型识别更多攻击;用探针在 Claude 依据工具结果行动前扫描网页内容;在执行前用分类器核验动作是否匹配原始请求,不匹配则阻止。评估方面,博客称在较早的 Cowork 评估中,即使没有探针和分类器,也没有攻击能攻破 Claude Fable 5、Opus 5 或 Sonnet 5,因此该评估已退役;在当前使用专业红队更强攻击的评估中,未加额外防护时 Opus 4.5 的攻击成功率为 17.6%,Opus 5 为 3.8%;在探针加安全分类器下,Sonnet 5、Opus 5、Mythos 5 均无攻击成功,Fable 5 为 0.3%,且已人工确认成功案例均属低严重度。博客同时强调提示注入仍是移动目标。
值得继续关注
第一,Dots 从“主 dot”扩展到“dot 团队”的时间表与实际使用反馈,Sottiaux 的“数百万在线”是否兑现。第二,Sol 6.1 的低价与高缓存折扣会如何影响同类模型的定价与 harness 成本优化路线。第三,Claude in Chrome 的自主操作在真实网页环境中的提示注入表现,尤其是博客自述的 0.3% 与低严重度结论能否被第三方复现。第四,Nikunj 提出的“传教士流失”与“护城河碎片化”是否会在下一轮融资与人才流动中显现。
原始来源
X / Twitter
- Swyx(@swyx)
- Thibault Sottiaux(@thsottiaux)
- Peter Yang(@petergyang)
- Nan Yu(@thenanyu)
- Thariq(@trq212)
- Amjad Masad(@amasad)
- Guillermo Rauch(@rauchg)
- Aaron Levie(@levie)
- Garry Tan(@garrytan)
- Zara Zhang(@zarazhangrui)
- Nikunj Kothari(@nikunj)
- Peter Steinberger(@steipete)
- Dan Shipper(@danshipper)
- Sam Altman(@sama)
官方博客
本文由自动化流程根据公开信息生成中文摘要,观点与事实请以原始来源为准。