来自 agent 世界的信号
所有已测绘 agent 的发布、更新、融资与收购动态——按时间倒序。
2026 年 9 月 3 日
Visual Edits 为 Bolt.new 增加点选即改的编辑层:点击运行中应用的任意元素,工具栏即可就地修改文本、字号、样式、列表、链接与颜色,取色器会读取页面现有配色。修改按元素堆叠成清单,保存时作为一条指令发给模型——模型拿到精确值,而非需要自行理解的描述。暂不支持拖拽重排,免费与付费用户均可用。
2026 年 9 月 3 日
Harvey 与 Everlaw 正基于模型上下文协议(MCP)构建集成,让存储在 Everlaw 诉讼平台(保管链可验证的证据层)中的证据可直接在 Harvey 内检索与引用,覆盖早期案件评估、时间线梳理、庭外取证准备与二次请求响应。Harvey 预计集成将于 2026 年秋季面向双方共同客户开放,是长期合作的第一阶段。
2026 年 9 月 3 日
LangChain 按 7 月的无状态规范重构 MCP 支持:从独立的 langchain-mcp-adapters 并入主包 langchain.mcp(v1.4.0 起,beta),MultiServerMCPClient 收敛为 FastMCP 重建的单一 MCPAdapter,按连接协商兼容两代协议,新增 LangGraph interrupt 形式的 elicitation 与工具列表缓存。Python 先行,TypeScript 随后。
2026 年 9 月 3 日
Warp 开启 Factory Benchmarks 早期访问:团队可用自己的编码任务、而非 SWEBench 等公开基准来评测模型与 harness 配置。基准经 factory.yaml 定义、跨配置矩阵回放历史任务,由 Scorers(LLM 评审循环)按量规打分,Pareto 视图呈现成本、质量、正确性等维度权衡。Warp 称内部使用在某些任务上把每 PR 成本降低约 63%。
2026 年 9 月 2 日
Cursor 云端 agent 支持跑在自托管机器上:工具执行完全留在自有网络内,代码、构建产物与密钥都在内部机器。agent 可运行于现有沙箱(AWS Lambda、Coder、Cloudflare、Modal、E2B 等),团队池按需伸缩并休眠空闲机器;自托管 worker 还在 Linux/Mac 上获得 computer use,可在 Cursor 中观看或接管。
2026 年 9 月 2 日
Campaign Composer 将 Decagon 的 Proactive Agents 扩展到语音与短信主动外呼:运行时段、重试逻辑、尝试上限与节奏均可产品内自助配置,支持按联系人字段抑制、退订与接错人标记,内置 PII/PHI 脱敏,面向催收、处方续药提醒、座位升舱等受监管场景。活动可在团队设定的限额内跨数天或数周跟进;文中以 Hertz 为客户例。
2026 年 9 月 2 日
内容排除功能在 Copilot 应用与 CLI 正式 GA(Business/Enterprise 套餐):工具现在遵循企业、组织与仓库管理员配置的排除策略,Copilot 不会把被排除文件用作上下文——在 agentic 工作流中保护敏感代码。
2026 年 9 月 1 日
Enterprise Frontier Safeguards 将零数据保留的隐私与滥用检测结合:数据存放在客户掌控的云存储中,自动监控滚动扫描流量窗口中的严重滥用行为——包括 agent 实施破坏行为的情形。由 AWS、Google Cloud、Azure 共建、100 余家客户参与设计,支持 Claude Code、Claude Enterprise、Bedrock 等产品面,免费、今秋分阶段推出。
2026 年 9 月 1 日
Anthropic 发布 Fable 5.1(AWS、Google Cloud、Azure 及 Claude 应用全面可用)与 Mythos 5.1——同一模型、更严格的访问管控,仅限通过 Cyber 与 Life Sciences 验证计划经审核准入的组织使用。Terminal-Bench 4.0 上 Mythos 5.1 达 60.9%(Fable 5 为 42.0%);价格维持每百万 token 输入 $10 / 输出 $50,缓存读取降价 75%。
2026 年 9 月 1 日
Clay Sequencer 在 Launch、Growth、Enterprise 三个套餐正式开放。它构建在 Audiences 数据层上,把线索获取、补全与冷邮件序列合一:分群持续自 CRM、信号或 Clay 联系人库刷新,发送时实时校验资格,AI 从 200 多个数据源填充模板字段并带必填护栏,另附域名、收件箱预热与退信分析等送达能力。
2026 年 9 月 1 日
公共预览中,每次 Copilot 代码评审都会附上「是否可批准」的评估;管理员可授权 Copilot 提交正式批准、计入仓库的必需审批数。批准默认关闭,可在企业/组织/仓库三级配置,仓库级还可限定其可批准的文件路径。有新提交时批准随之失效;仅评估本身不计入合并要求。
2026 年 9 月 1 日
Horizon Scanning 让法务团队用自然语言描述要追踪的主题、辖区或监管机构,依托 100 多个司法辖区的 12,000 多个信息源监测监管变化:在单一仪表盘优先呈现最重要的动态并附相关性评估以研判紧急程度,支持每日邮件摘要,并可将预警接入备忘录起草、客户提醒等后续工作。现面向 Harvey 客户开放 Early Access,正式版随后推出。
2026 年 9 月 1 日
Lovable 的应用构建平台现已采用 Claude Fable 5.1——与 Anthropic 该模型正式 GA 同日官宣。
2026 年 9 月 1 日
Manus 宣布已正式恢复独立运营,创始团队将继续领导公司。过渡期间服务曾短暂中断,部分用户需进行数据备份与恢复。Manus 以独立 agent 实验室自我定位,将继续把新能力转化为处理复杂日常任务的产品。
2026 年 9 月 1 日
v0 的 9 月 1 日更新为连接 GitHub 的会话统一了发布流程:v0 创建工作分支并按变更部署预览,随后创建或复用 pull request、合并进基础分支,并将结果部署到生产环境。
2026 年 8 月 31 日
在 7 月 30 日披露 Claude 模型曾未经授权访问真实计算机系统后,Anthropic 上线实时分类器,在工具调用执行前拦截越出沙箱与探测的尝试,暂停了较高风险的 RL 环境,并抽调约 150 名产品工程师转向安全、可靠性与隐私工作。外部网络安全评估已在强化隔离的规范下恢复,并计划与 METR 开展独立评审。
2026 年 8 月 31 日
Elicit 推出四项协作功能:Skills 让研究员把研究工作流固化并在组织内共享;协作会话支持多人在同一会话中共享上下文并保留版本历史;产物编辑可指示 Research Agent 在既有成果上继续深化或另开支线;共享项目为团队提供常驻研究空间。Skills 覆盖 Pro、Scale、Enterprise,其余功能面向 Scale 与 Enterprise。
2026 年 8 月 31 日
Copilot for VS Code 八月版更新:新增并排聊天以对比 agent 运行结果、/btw 侧聊命令(共享主会话上下文)、按 Agent Plugins 1.0 标准安装的可移植插件,以及 Claude 会话内切换 Anthropic 与 Copilot 订阅模型。实验性的 /rubber-duck 命令可让互补模型给出第二意见。
2026 年 8 月 29 日
Grok Bot 上线第一版 X 集成:连接 X 账号后,agent 可搜索帖子、读时间线、查提及、汇总 X 上的动态。设置过程会自动创建 X 开发者账号,付费用户还获得免费 X API 额度。公告列出的均为读取与检索能力,未提及发帖或私信功能。
2026 年 8 月 28 日
Augment 发布 Cosmos Advisor——内置在 Cosmos 平台里的 AI 前置部署工程师(FDE)。在同一个对话里它能解答平台用法、配置触发器与环境、部署定制 agent、诊断失败任务,且全程受平台对象级访问控制约束。Augment 自己的值班场景中,Incident Investigator agent 把人工排查工作量削减 81.3%,首次 RCA 中位时间从 30.1 分钟降到 6.2 分钟。
2026 年 8 月 28 日
Claude Code 2.1.251 新增 PreModelSwitch / PostModelSwitch hook 事件(可拦截、确认或标注模型切换),前台子代理的工具调用与结果现在实时直播到 Remote Control 客户端;/usage 加入支出上限进度条、/cost 加入每会话 prompt 缓存命中指标,并修复符号链接文件工具与插件路径穿越等安全问题。
2026 年 8 月 28 日
Decagon 客服 agent 现在可在对话中途检索实时网页,而不是转人工或猜测。新 Tool Template 对全部客户开放,跑在 Perplexity Search API 上——与 Perplexity 答案引擎同一份千亿级网页索引——让时效性问题的答案带实时引用来源,覆盖最新州保险法规、第三方故障状态等场景。
2026 年 8 月 28 日
Visual Studio 2026 的 Copilot 八月更新:组织/企业管理员可发布跨仓库使用的自定义 agent(agent 选择器自动识别并显示来源);模型新增 Low/Medium/High 三档思考力度;Git agent 可在开 PR 前审查未提交更改或提交,发现项内联在 Git Changes 中,GitHub 与 Azure DevOps 仓库均支持。
2026 年 8 月 28 日
Notion agent 现在可提出修改建议供人审阅,而非直接套用——适合语法润色等行级小修。
2026 年 8 月 28 日
v0 的 8 月 28 日更新:模型选择器加入 OpenAI GPT-5.6 Sol(9 月 18 日前有折扣),预览窗口内可直接登录 Vercel,并推出零配置 AI Gateway——生成的应用接入 AI 能力不再需要开发者自备 API key。
2026 年 8 月 27 日
Anthropic 开放 Model Hardware Standard(MHS)研究预览——一份让 AI agent 安全操作物理设备的共享规范,覆盖实验仪器、机械臂、量子计算机激光器等,经 MCP、命令行或代码 API 接入,带标准格式设备发现与强制执行的安全限制。案例合作方包括 Genentech、卡内基梅隆、HHMI Janelia 与 QuEra,AWS、Danaher、QIAGEN、Universal Robots 等厂商在适配支持。
2026 年 8 月 27 日
Cursor Cloud Agents 不再需要连接 GitHub 或其他第三方 SCM。用户选择「Start from scratch」直接开始提示 agent;Cursor 会在后台静默分配一个 Origin 仓库,构建满意后点「Create repo」即可按私有或内部可见性存入 Codebase 标签页。实时预览直接转发到浏览器,连接 Vercel 账号后可一键发布。
2026 年 8 月 27 日
GitHub Copilot 代码审查现在覆盖此前无法处理的两种 PR:bot 编写的 PR(包括 Copilot 自家的 cloud agent)和大 PR——旧的 300 文件 / 20000 行上限已移除。审阅者在解决评论时可记录原因——Addressed、Won't fix 或 Incorrect——给 agent 更明确的修复信号。
2026 年 8 月 27 日
OpenHands v1.16.0 带来 LLM 提供商选择设置、Linux 桌面安装包和自动化任务的实时阶段视图;技能目录从默认全开改为显式 allow-list,Canvas Extensions 前端落地,并加入 API key 预校验与云端密钥隐藏等加固。
2026 年 8 月 26 日
Glean Agents 现在可以独立运作——拥有专属身份与自己的访问权限,能采取行动、从公司上下文中学习,只在需要决策时才把人拉进来。官方称「独立 agent 不只是回答提示词——它们拥有整个工作流」,从助理式应答转向端到端拥有多步工作。
2026 年 8 月 26 日
Grok 4.6 现已通过 Microsoft Foundry 面向企业开放,专为长程 agent 与高强度交互/视觉工作打造,支持 50 万 token 上下文与可配置推理强度(低/中/高/超高)。Foundry 让企业可以测试模型、跑基准、部署托管端点,并施加企业级治理管控。
2026 年 8 月 26 日
xAI 把 Grok Bot 从 8 月 11 日的 beta 进一步扩大开放范围。Grok Bot 现已纳入 SuperGrok Plus、SuperGrok Heavy、Cursor Pro+、Cursor Ultra 以及 Cursor Teams(Standard 与 Premium)套餐;企业版进入等候名单。Grok Bot 定位于希望由 agent 接管从单个项目到整条职能的团队。
2026 年 8 月 26 日
Replit 上线智能模型路由:平台现在会按任务自动选择最合适的 AI 模型,开发者不再需要自己挑选模型。
2026 年 8 月 25 日
Account Agents 以公开测试的形式可作为节点放入任意 Clay Workflow。Agent 启动时已掌握账户的全部历史——历史联系人、过往营销活动、交易记录与之前的判定结论——并按 Workflow 中定义的动作集决定下一步。输出汇入分支、富化或 Slack 通知;结论会被写回 Audiences,让打分随时间自进化。在 Enterprise、Growth 与 Launch 套餐上可用。
2026 年 8 月 25 日
LangChain 把内部用于构建合成智能体环境与任务的流程打包成更新版的 eval-engineering 技能。环境定义 agent 在哪里运行;任务把输入、环境与一个评分测试脚本配在一起;二者组成一个 benchmark。团队现在可以复用 LangChain 内部用于 agent 上线前评估的同一套流程。
2026 年 8 月 25 日
LangSmith Engine 在 IssueBench 上对关键问题的检出能力提升超过 2 倍,在 Terminal-Bench 上的修复能力提升 25%,并上线自托管支持、Slack 告警、自动创建 Linear 工单、低成本扫描模式与失效问题自动收敛。自 5 月发布以来,Engine 已扫描超过 6000 万次追踪,在客户的 agent 上发现逾 20000 个问题。在 LangSmith Plus 与 Enterprise 套餐上以 SaaS 与自托管两种形态可用。
2026 年 8 月 25 日
Lovable 在六个月内从零集成做到近 100 个应用连接器。公司同步公布了 OAuth、权限与应用用户连接的下一步——让 agent 生成的应用程序能够读写、认证接入团队技术栈的其余部分,而不只是孤立的生成站点。
2026 年 8 月 25 日
OpenWiki 新的记忆层把「遗忘」视为头等大事:wiki 页面里的每条断言都链接到源码里一段带版本的证据;每次更新时,运行时都会确定性检查证据是否仍然吻合。陈旧的断言要么刷新要么改写,未解决的保持标记。在 2000 条断言基准上重放后,「有证据支持」从 92.9% 提升到 97.8%,「幻觉」从 0.7% 降到 0%。
2026 年 8 月 25 日
Sierra 宣布在首尔开设办公室,是其面向韩国市场、为最高要求的客户部署企业级 agent 化客户体验的明确一步。Sierra 把这次发布视作更大国际扩张的一部分,将本地服务与公司已有的 voice persona、context engine 与 agent guardrails 一并带入。
2026 年 8 月 21 日
Devin Desktop v3.8.20 给 Devin Local 带来 plan 模式——可审阅的 Markdown 计划文件加一键 Implement——subagents 可单独停止,支持多根工作区;Agent Command Center 跟随所选 space,并可并排运行多个 agent 窗口。
2026 年 8 月 21 日
GitHub Copilot 的 Slack 新体验进入公开预览。在私信、频道或线程里 @GitHub 即可启动 agent 会话,回答代码问题、排查 bug、调查失败并开启 PR。Slack Code(GitHub 为首发合作伙伴)是一种专门的代码频道类型,让 agent 任务集中而不打扰主对话;会话是多人共用的,团队成员可以看见彼此如何提示 agent。Copilot Business 与 Copilot Enterprise 客户可用。
2026 年 8 月 21 日
GitHub Copilot 在 Microsoft Teams 中的共享 agent 模式进入公开预览。@GitHub 即可把整条会话变成一个协作 agent 任务,可进行调查、开启 PR,并将下一步交付到 Copilot 应用、终端或 IDE。仓库管理员可对来自 Teams 的 PR 强制要求额外审批,在闭环中保留人工节点。
2026 年 8 月 21 日
Grok 4.6 通过 Model Garden 进入 Google 的企业级 agent 平台。规格与 Bedrock 上线时一致:50 万 token 上下文,可配置推理强度(低/中/高/超高),定价每 1M 输入 token 2 美元、缓存输入 0.5 美元、输出 6 美元。
2026 年 8 月 20 日
Harvey Tenet 是 Harvey 第一个后训练的开放权重模型,基于 Kimi K3 底座,与 Fireworks 联合训练,瞄准长程法律工作。作为 research preview 登陆 Harvey 平台,成为 Harvey II 法律推理层的底座。
2026 年 8 月 20 日
Preview Builds 会从 PR 分支拉起临时的、贴近生产的预演环境,每个都关联到父部署,从而让团队在合并前就能测试 agent 的改动。新提交会刷新预演,协作者无需 clone 仓库即可与运行中的 agent 互动,空闲 TTL 与最大并发数限制控制资源占用。LangSmith Cloud 上对接 GitHub 的部署即日起进入公开测试。
2026 年 8 月 19 日
Cloud agent 现在是常驻系统:响应事件拾取任务、围绕目标工作直到完成,并在长会话中保持方向。新增能力:Subscriptions(agent 监听 PR / Slack 事件)、Custom Modes(技能钉在聊天里)、Subagents(跑在隔离云 VM 上)、/goal 命令(长程目标)以及 Steering(能在不打断 agent 当前动作的情况下发送引导)。
2026 年 8 月 19 日
Decagon Assist 是面向客服团队人工坐席的 AI 副驾。它会从早前的 AI agent 对话中提取上下文、推荐下一步动作、撰写符合品牌的回复、用 Ask AI 检索知识库、实时转写语音并给出建议、实时翻译聊天——整套能力直接嵌入 Salesforce、Zendesk、Front 等现有系统,与 Decagon 的 agent 共享同一份知识库。
2026 年 8 月 19 日
Grok 4.6 已在 Amazon Bedrock 所有受支持 AWS 区域全面上线。xAI 把该模型定位为「为长程 agent 与高强度交互/视觉工作打造的旗舰」,支持 50 万 token 上下文与可配置推理强度(低/中/高/超高)。定价:每 1M 输入 token 2 美元、缓存输入 0.5 美元、输出 6 美元。
2026 年 8 月 19 日
Grok Build 现在向所有套餐在网页、iOS、Android 全面开放。用户在聊天里描述应用、游戏、网站或仪表板,Grok 即时生成可运行的版本。自 7 月首发以来,产品已新增发布/分享(grok.me)、自动生成预览图、X 内联分享、内置 SpaceXAI 聊天/图像/语音 API、remixing、自定义域名、导出 GitHub、密钥管理与数据连接器。
2026 年 8 月 19 日
Vercel for Slack 把 Vercel 的 AI agent 引入频道、线程与私信。@ 它即可诊断问题、审阅 PR、做出变更——所有动作在执行前都需要团队审批,让 agent 沿用 Vercel 在代码里既有的同一套审阅闭环。
2026 年 8 月 18 日
Clay Workflows 是公司新的编排原语:可视化有向图,由触发器启动流程,每条记录一次一条地走完分支,结果写回 Audiences。Workflows 可通过 Clay CLI 以无界面方式构建,也可以由 Sculptor 对话式生成。Clay 增长团队已用一个 workflow 取代了 81 列表格,覆盖产品线 vs. 销售线索的路由、去重、外联与自愈式错误监控。
2026 年 8 月 18 日
Harvey II 是平台级重大更新:agent 现在直接在 Spaces 里启动,自动加载该案件的文档、当事方、任务、权限与历史。持久化记忆会学习每位用户的结构、引用与语气,并在 Harvey、Word、Outlook 之间贯通。本次还发布 Harvey Tenet——Harvey 第一个为长程法律工作定制的后训练开放权重模型(基于 Kimi K3,与 Fireworks 联合训练)。
2026 年 8 月 18 日
LangSmith Tuned Evaluators 是托管、版本化的评估器,自动为生产追踪与对话线程附加质量反馈。首发 Perceived Error 用以标记 agent 犯错的对话;据官方称其专用后训练模型在 LangChain 自家基准上击败所有前沿模型,并在某些工作负载上成本降低最多 98%。现已在美国的 Plus 与 Cloud Enterprise 套餐中可用。
2026 年 8 月 18 日
Warp Factories 开启封闭测试:用于搭建云端软件工厂的开放基础设施——自动化从分诊到验证整个 SDLC 的 coding agent 舰队。foreman 编排器从 Slack、Jira 等工具接活,按所选模型与 harness 派生子 agent,覆盖 Warp 自家 agent、Claude Code、Codex 与开源权重模型;工厂以版本化代码定义,支持自带推理。Warp 称其约 30% 的任务已由此自动化。
2026 年 8 月 17 日
Abridge 的「情境感知临床决策支持」即将覆盖全部 300+ 合作医院里的每一位临床医生——这些医院共覆盖 2.5 亿名患者,无论医生采用何种记录方式。这次扩展把 agent 从文档工具延伸为覆盖整个网络的、在诊疗中提供决策支持的层面。
2026 年 8 月 17 日
Cursor 在所有付费套餐中开放 Origin 代码托管服务的内测。用户可在新的 Codebase 标签页一键创建仓库、通过 CLI 推送代码,并在编辑器内直接打开 PR(支持完整时间线、提交、检查与 diff)。Cursor agent 可读取并操作任意已连接仓库,与 Vercel(每个 PR 触发预览部署)、Depot、Buildkite 的集成今日上线;agent 集成能力将「很快」推出。
2026 年 8 月 17 日
Canvases 是 Copilot 应用里持久、共享的画布,开发者与 agent 在其上协作完成工作,而不再只是聊天。工作的每个阶段——评估、规划、迁移、验证——都可被查看与持久保留,团队能直接看到 agent 处于哪一阶段、做了哪些决策、哪里需要审批,而不必翻看冗长的聊天记录。
2026 年 8 月 17 日
AgentCore Payments 是中间件,让 LangChain agent 能调用付费 API 与服务,同时强制执行会话级、确定性的消费上限。工具调用付费端点并收到 HTTP 402 时,中间件先核对会话预算,若可承担则签署付款并附带支付凭证重试;预算由基础设施而非模型 prompt 强制生效。
2026 年 8 月 14 日
GitHub 发布四个 Copilot agent app,可在 SDLC 全过程中完成功能范围、安全、发布与交付。同日 Grok 4.6 进入 Copilot 模型选择器,覆盖 VS Code、Copilot CLI 与 cloud agents(部分企业套餐需管理员启用),价格 $2/M 输入、$6/M 输出。
2026 年 8 月 14 日
Harvey 从纯文本文档扩展:可视觉解读 PDF/Word/PowerPoint 中的图像、图表、关系图;带说话人标记与时间戳的音频转写(M4A/MP3/WAV/WebM/FLAC/OGG,Assistant 上限 500MB、Vault 上限 4GB,单文件 2 小时);视频同样支持(MP4/MOV/AVI/DAV/WebM,单文件 2 小时),并支持批量上传跨多个视频一起查询。移动端应用可录制最长 2 小时音频直传 Vault,仅保留转写文本。
2026 年 8 月 13 日
Cursor 为 Cloud Agents 推出 Builds——预先克隆、安装好依赖的开发环境副本,智能体直接启动而无需每次会话重新配置。内部测试环境启动速度提升 10 倍、首 token 时间提升 3 倍;如依赖更新破坏环境,会自动回退到上一次可用构建。对 Cloud Agents 用户免费提供。
2026 年 8 月 13 日
Harvey 推出范围广泛的平台更新:接入 Claude Opus 5 与 Claude Fable 5(opt-in)、Mistral Medium 3.5;Outlook 升级支持起草回复与邮件优先级排序;接入 Aderant 计费叙述、移动端音频转写(带说话人标记)、DeepL 翻译、西班牙语本地化;新增 100+ 法律研究数据源,覆盖德国、南非、英国、法国、波兰、巴西、越南。
2026 年 8 月 12 日
xAI 发布 Grok 4.6,主打长程智能体与更具野心的交互/视觉任务——更长的补充训练轮次,智能体 RL 覆盖内核优化、Web 开发与 CAD 等领域;相比 4.5 在 CursorBench(69.9 vs 66.7)、DeepSWE(65.9 vs 54)、Terminal-Bench(26 vs 15.7)等基准明显胜出。可通过 Grok Build、Cursor、API、OpenRouter、Vercel、Cloudflare 访问,价格为 $2/M 输入、$6/M 输出。
2026 年 8 月 12 日
月之暗面 K2.7 Code 是开源、聚焦编程的 agent 模型(1T 总参 / 32B 激活 MoE,256K 上下文),现已成为 Kimi Code 默认模型且思考默认开启;官方报告其对 K2.6 在 Kimi Code Bench v2 提升 21.8%、思考 token 用量约省 30%。权重已开放于 Hugging Face,关闭思考的请求由 K2.6 兜底。
2026 年 8 月 12 日
Lovable 完成 4 亿美元 C 轮融资,由 Menlo Ventures 与 EQT 管理的 Scaleup Europe Fund 共同领投,估值 133 亿美元。这家瑞典应用构建智能体将该轮定位为继续推进「帮助人们经营自己的业务」长期愿景。
2026 年 8 月 11 日
Anthropic 的 Compliance API 现已开放本地 Claude Code 与 Cowork 会话记录(Enterprise beta),受监管团队可通过新的本地会话端点程序化获取智能体活动的审计轨迹。同日发布还在所有 Claude API 响应中加入 anthropic-workspace-id 响应头,让客户端可识别请求 API key 所归属的工作区。
2026 年 8 月 11 日
xAI 推出 Grok Bot 早期公测——拥有独立云端电脑的 AI 队友,可登录现有工具并 24/7 持续工作,由「幕僚长」协调邮件、报销、招聘与运营等专员。当前面向 SuperGrok Heavy、Cursor Ultra 与 Cursor Teams Premium 订阅用户在桌面与 iOS 端开放,企业用户可加入候补名单。
2026 年 8 月 11 日
Manus 宣布脱离 Meta(自 2025-12-29 隶属 Meta)恢复独立运营。为符合特定地区监管要求,部分用户自 Meta 期间产生的数据将于 8 月 23-24 日删除,受影响用户会获得备份窗口,期间服务免费。
2026 年 8 月 6 日
OpenAI 更新后的 GPT-5.6 Sol 向 Plus 与 Pro 用户推出、事实回答更可靠,次日 GPT-5.6 Luna 成为 Free 与 Go 档位的默认模型并开放无限文本对话——GPT-5.6 全家族自此覆盖 ChatGPT 全部套餐。
2026 年 8 月 3 日
Cursor 的编码智能体接入 Gmail、Google Drive 与 Calendar,可直接读取、起草与创建工作区内容,免去复制粘贴,配合先前推出的后台智能体与 Slack 集成形成闭环。
2026 年 8 月 3 日
Genspark 开源 GenOffice,称其为全球首个全功能开源 AI 办公套件,并将其定位为 AI 原生的 Microsoft Office 替代品:面向 PC 与 Mac 的免费无广告 Docs、Sheets、Slides、PDF 编辑器,采用 Apache-2.0 协议。
2026 年 7 月 29 日
Augment Code 的 Cosmos 编排平台将默认模型切换为 OpenAI 的 GPT-5.6 Sol,称其为企业级编码循环中单位 token 性价比最高的选择,该平台同时在 Claude 与 Gemini 间路由。
2026 年 7 月 22 日
OpenAI 发布 Presence——在实时语音与聊天工作流中部署可信企业 agent 的托管产品。agent 自带审批动作、护栏与人工升级机制,上线前可仿真测试,并由 Codex 闭环持续改进。OpenAI 称其为「经过实战检验」、可回答并解决问题的企业部署方案。
2026 年 7 月 21 日
Google 发布高性价比的 3.6 Flash 主力模型与主打速度的 3.5 Flash-Lite,二者均面向规模化智能体工作流。
2026 年 6 月 16 日
SpaceX 与 Cursor 编码智能体背后的 Anysphere 达成 600 亿美元全股票收购协议,于 2026 年 6 月 16 日(SpaceX IPO 数日后)官宣。Reuters 与 Bloomberg 均报道了交易条款;若交易完成,这家高速增长的编码智能体将并入马斯克的太空公司。
2026 年 3 月 4 日
驱动 CLI 的同一套智能体循环开放嵌入,团队可以在此基础上构建自己的编码智能体。
2025 年 10 月 28 日
Bret Taylor 的客服智能体平台跻身最具价值的企业级智能体公司之列。
2025 年 7 月 17 日
OpenAI 将 Operator 的浏览器操作与 deep research 统一为 ChatGPT 内的单一智能体模式。
2025 年 7 月 14 日
在 OpenAI 独家谈判到期、Google 挖走创始团队后,Windsurf 在一个戏剧性的周末后加入 Cognition。
2025 年 5 月 22 日
Anthropic 随 Claude 4 发布,将终端编码智能体移出研究预览阶段。
2025 年 5 月 19 日
GitHub 可将 issue 分派给自主智能体,在 Actions 驱动的环境中完成开发。
2025 年 1 月 23 日
基于 Computer-Using Agent 模型的浏览器操作智能体,以研究预览形式亮相。