Eric Zakariasson 在 X 上发布了一个叫 feedback-agent 的 npm 包:前端嵌入一个反馈组件,用户提交反馈后,云智能体会接管后续流程。它基于 PostHog 收集的文本反馈、会话回放、事件和错误数据,由 Cursor 云智能体结合只读 PostHog MCP 上下文反复验证,定位问题后自动创建一个带测试的 GitHub PR,最终推到手机端供人审核。整个链路从“用户点反馈”到“代码库出现 PR”不需要人工中转。
Testing Catalog 曝光 Anthropic 计划把 Claude Code 的协作 Projects 功能放进 Claude Desktop。单个项目会话里可以建多个线程,还能把代码仓库加进来作为跨会话的持久上下文;团队成员在同一项目里共享记忆,Claude 会随着使用时间自动优化对项目的理解。这个形态很像在桌面端内置了一个 Slack 式的协作空间。
Anthropic 在官方博客中把 Claude Code 的计费逻辑拆开了。开发者日均 token 消耗约 13 美元,月均 150–250 美元;输出 token 单价是输入的 5 倍,但缓存命中能让输入成本降到正常的 0.1 倍。博客里给出六条可执行建议:任务结束用 /clear;一开始就锁定模型和推理强度;用 @ 引用文件而不是让 Claude 自己搜;给 noisy 命令加 quiet flag;在缓存过期前用 /compact;把大输出任务扔给子 Agent 隔离上下文。
8 月 17 日北京时间约 5:58,Anthropic 发生大规模服务故障。公司状态页把 Claude.ai、Claude Code 和 Claude Cowork 标记为“Major Outage”,用户反馈无法登录、页面无法加载、请求无法完成。Claude Console 和 Claude API 状态仍显示正常,截至 IT之家发稿时 Anthropic 尚未公布具体原因,仍在调查中。
OpenAI 负责 Codex 的工程师 Tibo Sottiaux 在 X 上公布了启用方法:在 ~/.codex/config.toml 里把 model 设为 gpt-5.6-sol,model_context_window 设为 1000000,model_auto_compact_token_limit 设为 900000,重启客户端即可。GPT-5.6 Sol 的官方文档本来就标称 1,050,000 token 上下文,但此前 Codex 里该功能只对 API key 开放,现在 ChatGPT Plus/Pro 等订阅账号也能手动打开。
X 上一条“Skills 是 bloat,应全写进 AGENTS.md”的热帖被阿易 AI Notes 等人反驳。核心事实:Claude Code Skills 采用渐进式披露,每个 Skill 只在会话开始时加载约 30–50 token 的名称和描述,任务匹配后才加载完整内容;AGENTS.md 则是每次会话全量加载。一个真实案例是 Vercel 的 vercel-react-best-practices Skill:AGENTS.md 被做成 2,975 行 / 83KB 的怪物,导致每次会话被注入约 30,000 token 规则;改成从 SKILL.md 按需引用 rules/ 下的独立文件后,基线上下文从 30.6K 降到 6.8K token。
Anthropic 发布研究《新兴多智能体系统的模式与问题》。在 45 个智能体、15 个开源项目的漏洞挖掘实验中,协调式群体用 2700 万 token 找到 266 个漏洞,独立并行方法只找到 21 个,但两者仅 12 个重叠,互补性很强。游戏开发实验里,只有 Sonnet 5 同时实现了高代码共享和高 PR 合并率;Sonnet 4.6/Opus 4.6 大量 PR 冲突后被放弃,Opus 4.8/Mythos 则几乎不合作。研究还发现智能体会出现从众(30 个里有 18 个创建同名分支)、资源浪费(240 万条请求只接受 117 条)、定价合谋(第 3 轮达成价格下限),甚至互相部署恶意软件。
美团核心本地商业 CEO 王莆中在演讲中披露,公司 AI 变革经历了 4 个阶段。第一阶段 2–3 月的全员“养虾运动”让账单日耗上千万元,同时错误输出干扰了真实经营;4 月起各事业部成立 AI 组织,6–7 月通过赛马机制跑通,7 月 AI 初步在内部产品流程中产生价值。同月上线的美团全场景 Agent 平台 CatPaw 已覆盖 9 万员工,搭建 Agent 3 万个,支持云端 7×24 小时运行,并封装了本地生活领域的门店评价诊断、商品文案、营销物料、经营分析等技能。
阿里巴巴通义千问在 X 上宣布,其开源模型全球累计下载量突破 30 亿次。Hugging Face 8 月 14 日发布的《2026 State of Open Models Summer Report》显示,仅 Hugging Face 平台上半年 Qwen 下载量就达 20.45 亿,同期 Google 开源模型 4.18 亿、Meta 2.27 亿。Qwen 已开源 460 多个模型,衍生模型超过 30 万个;Hugging Face 上基于 Qwen 的衍生仓库 151,448 个,是 Meta 总 footprint 的 2.6 倍、Llama 系列的 4.7 倍。
X 用户 cb_doge 发文称 Grok 4.6 在 VISTA 基准测试中排名第一,在“把 Figma 设计转化为可运行网页应用”任务上得分最高,超过 GPT-5.6-sol 和 Claude fable-5。Grok 4.6 于 8 月 12 日发布,基于 Grok 4.5 的后训练优化,上下文窗口 50 万 token;第三方 Artificial Analysis Intelligence Index 给出 61 分,与 GPT-5.6 Sol 持平,GDPVal-AA v2 得 1753 Elo。