1. Google推出Gemini agent,企业员工多了个AI同事账号
一句话: 代理有自己的Workspace账号和邮箱,可接MCP服务器。
Google Cloud在「Gemini at Work 2026」博客里宣布了Gemini agent,官方说法是「single, universal agent for work」。TechCrunch在10月8日报道了这次发布,并写明Google会先面向企业,之后再推向个人用户。
Google为代理单独分配身份。按官方原文,代理会拿到自己的Workspace账号,带邮箱、日历、Drive,也会出现在公司通讯录里。所谓coworker agent用 @agents.company.com 这类独立邮箱,只能看到你或同事主动分享给它的内容。
官方还说,代理操作的审计记录会归到代理名下,而非员工本人。评估企业代理时,可以据此检查一个具体问题:操作日志能否区分人和代理,撤销代理权限时是否需要动员工账号。
Google列出的连接对象包括Confluence、Microsoft Office、Teams、Slack、Git、Jira、Salesforce、ServiceNow、BigQuery、Databricks、Postgres、Snowflake,还能连「any Model Context Protocol (MCP) server」。成本上,管理员可以在Cloud Billing Console给项目设硬性花费上限,触发后该项目的代理暂停,需要人手动恢复。
可用性方面,Google博客没有给出Gemini agent本体的正式可用日期、价格和地区,只写明金融和法律行业的专门版本「now in preview」。澳洲企业现在能不能开通,要看自己的Google Cloud控制台,别按发布稿默认可用。
澳洲团队评估这类产品,可以把独立身份、分享权限和花费上限列入供应商问题清单;这些设计本身不证明代理执行任务一定可靠。
2. Anthropic改使用政策,11月12日生效
一句话: 选举、虚假账号、武器软件和监控条款都写得更具体。
Anthropic在10月8日发布使用政策更新,原文写明「The updated policy takes effect on November 12」。TechCrunch同日做了独立报道。
这次更新大多是在澄清已有规则,也新增了针对自主硬件操作和持续无必要辱骂模型的要求。
选举:原有条款改名为「Do Not Undermine Democratic Processes」,重点是禁止用Claude欺骗选民或干扰选举。
欺骗性活动:新条款覆盖「deceptive activity of any kind (whether political or commercial)」,包括隐藏消息背后是谁、用虚假账号或帖子放大内容。这条同时覆盖商业活动。营销自动化团队需要检查虚假账号和隐藏发布者身份等功能。
武器和监控:Anthropic称原本就禁止相关用途,这次写得更明确。禁止范围包括「the software and components that make weapons work」,也就是不只是实体武器;未经同意追踪他人被禁止,开发或改进监控工具同样被禁止。
对模型的辱骂:新增禁止「sustained and needless abusive or cruel behavior toward our models」。Anthropic和TechCrunch都写明,普通的抱怨、反驳、黑暗创作题材、模型测试和研究不在其中。这说明辱骂条款不覆盖原文列出的模型测试和研究;测试仍需遵守其他适用条款。
使用Claude API做批量内容生成、舆情分析或人员信息聚合的团队,可以11月12日前把功能清单对照新政策过一遍,尤其是「追踪他人」和「虚假账号放大」两条。政策里的具体判定口径以Anthropic原文为准,本文不替代合规意见。
3. OpenAI公开719份数学稿件,验证仍未补齐
一句话: 约42%的主要结果有Lean形式化,其余仍待核对。
OpenAI在GitHub仓库 openai/math 公开了一批由内部模型产出的数学稿件。README写明:「The current catalogue contains 719 manuscripts organized into 372 families」,大部分结果用同一流程、由一个未发布的内部模型得出,评估过程中模型被问了约4,000个问题。
验证范围需要单独看。OpenAI在README里写明:仓库约42%的主要结果已经做了Lean形式化,不是所有稿件都有形式化,「Some of the unformalized results could have issues」。换句话说,这是一批处于不同验证阶段的结果,不是719个已确认的定理。
数学界的反应集中在「标准」上。AGMAI在9月29日发布准则,要求AI实验室公开模型名、提示词和思维链摘要,证明尽量形式化,并附上把自然语言证明和形式证明对应起来的机器可读元数据。TechCrunch统计后写道,719份稿件里只有10份附带了思维链。
形式证明和自然语言证明还可能不一致。10月6日提交到arXiv的一篇论文专门看了Navier-Stokes相关结果,摘要指出「the formalised Lean proof does not correspond to the NL proof」——Lean代码通过了,但证明的未必是自然语言里声称的那件事。这不等于结论被推翻,只说明「Lean验证过」这句话本身需要再核对。
阅读这批稿件时,需要分别核对自然语言主张、Lean中实际形式化的命题,以及两者的对应关系。仓库里有证明文件,不等于这些检查都已经完成。
来源:OpenAI GitHub一手记录 · AGMAI准则 · arXiv论文 · TechCrunch独立报道