← 子沐研究室

AI BUILDERS DAILY

AI 构建者日报 — 2026-09-09

2026-09-09 · 子沐

用大白话讲今天 AI 圈发生的大事 · 国际 + 国内

用大白话讲今天 AI 圈发生的大事 · 国际 + 国内

国际 · 构建者动态

OpenAI 把 Astra 免费额度全量重置了(Thibault Sottiaux,OpenAI Codex & ChatGPT 负责人)

《OpenAI 重置所有用户 Astra 使用额度》:Sottiaux 直接宣布"所有人的额度都重置了,好好享受 Astra 的一周"。此前大量用户反馈 Astra 用得太快、额度不够,这次重置等于给所有人发了新的"体验券"。他还晒了一张 28 页的内部路线图 PPT,说 Codex 团队正在跟踪每一个即将发布的功能,"每一个我都等不及看大家能玩出什么花来"。

Replit CEO:现在的 AI 功能上已经和 AGI 没区别了(Amjad Masad,Replit CEO)

《Replit CEO 称当前 AI 已"功能上 indistinguishable from AGI"》:Masad 说"我不认为我们已经达到了 AGI,但我们现在拥有的东西,功能上已经和 AGI 没区别了"。原因很简单:我们有一个不知疲倦、不会无聊的程序员,任何能被拆解成编程问题的任务,它都能持续干下去。同一天 Replit 在伦敦开了第一个海外办公室,伦敦市长 Sadiq Khan 亲自到场。

Vercel CEO 发开源资助 v2:35 人每人 1000 美元,重点投 Agent 技能(Guillermo Rauch,Vercel CEO)

《Vercel CEO 启动第二轮开源资助计划,聚焦 Agent Skills》:Rauchg 宣布个人开源资助 v2,给 35 位优秀贡献者每人 1000 美元。主题很明确:① Agent 技能和工具——"技能现在已经是一种有价值的软件形态";② 其他基础设施。同时他还预告了 agent-browser 的新功能:高质量视频录制,说"你的软件工厂需要高质量的录屏",这是自动化软件工程新瓶颈的解决方案。

Box CEO:AI 抢工作的预测正在反向兑现(Aaron Levie,Box CEO)

《Box CEO 指出 AI 就业影响与预测相反》:Levie 说"AI 对就业的预测,到目前为止正在朝着和很多人想的相反方向发展"。原因是 AI 把自动化带到了那些需求没有上限的领域——以前这些领域因为人力成本太高做不了,现在 AI 能做了,反而创造了更多工作。他还提醒创业者:AI 进步这么快,做产品的时候至少要按"能力提升几个数量级"来规划,别按现在的水平想。

开发者反馈:Astra 自动触发自定义技能的能力变差了(Peter Yang,AI 教程作者)

《开发者反馈 Astra 技能自动触发准确率下降》:Peter Yang 说"不知道是不是我操作有问题,但 Astra 自动触发我的自定义技能、以及按技能里的指令执行的能力,好像变差了"。这条反馈虽然点赞不多,但代表了一批重度用户的真实体验——模型越强,用户对"它能不能自己调用对工具"的期望也越高,这恰恰是 Agent 落地的核心痛点。

国内 · AI 动态

硅谷开始倒查员工 AI 账单:单人一个月烧掉 19 万

《单人一月烧掉 19 万,硅谷开始倒查员工 AI 账单》:AI 工具用得越爽,账单越吓人。硅谷公司发现员工的 AI 订阅和 API 费用正在失控,有人一个月花掉 19 万美元。现在各家开始严查:哪些账号是重复的、哪些工具根本没人用、哪些 API 调用是浪费的。AI 降本增效,先从自己的账单开始。

字节开发实时空间视频生成模型,张一鸣亲自督导

《传字节开发实时空间视频生成模型,张一鸣亲自督导》:字节正在做一个能实时生成空间视频的大模型,张一鸣直接盯进度。空间视频就是能让观众从不同角度看画面的 3D 视频,比普通 2D 视频高一个维度。如果做成,短视频行业可能又要变天。

GPT-6 Astra 打穿 AI 智商测试:符号世界模型是突破还是刷分?

《打穿 AI 智商测试!GPT-6 Astra 的符号世界模型,是突破还是钞能力刷分?》:GPT-6 Astra 在各种智商测试和推理 benchmark 上拿了离谱的高分。文章拆解了它背后的"符号世界模型"——就是让 AI 在脑子里先建一个抽象的世界再推理。但也有人质疑:这到底是真的智能突破,还是用海量算力和数据把测试刷穿了?

拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结"模型论"

《拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结"模型论"》:Claude 5.1 能连续工作 38 小时不中断,这不是模型参数变大了,而是 Anthropic 换了思路——不再只拼模型本身,而是把长时记忆、任务调度、错误恢复做成了一套系统。文章说这标志着"比谁模型大"的时代正在结束,"比谁系统稳"的时代来了。

Agent 选工具只需 500 个 Token,判断用不用你的软件就是一瞬间

《判断用不用你的软件,Agent 只需 500 个 Token》:以前用户选软件要看评测、比功能、试半天。现在 AI Agent 决定调不调用你的工具,只需要花 500 个 Token(大概几毛钱)扫一眼你的 API 文档就决定了。这意味着软件的"门面"从 UI 变成了 API 文档和工具描述,写不好文档等于把客户拒之门外。

DeepSeek V4.1 Flash 悄悄开测:新架构、原生多模态、有效期只到 9 月 10 日

《刚刚,DeepSeek V4.1开启测试》:9 月 8 日下午,DeepSeek 在官方群突然宣布 V4.1 Flash 中间版本开始内测,没有发布会没有预热。新模型换了架构、原生支持多模态、速度更快成本更低。最有意思的是官方直接问用户:"你觉得这个模型能全面替换线上的 V4 Pro 吗?"——用 flash 打 pro,DeepSeek 自己卷自己。(原文为微信公号,附36氪转载)