EasyHub工具与知识
站点导航
中文

网站外观

主色与风格,自由搭配

主色调玫瑰粉
视觉风格不改变内容与功能

柔和渐变 · 立体图标

已应用:玫瑰粉 · 灵感,自动保存到此浏览器。

AI 资讯

727 篇选读241 个来源

最近原文 / 2026
EasyHub 编辑示意图 · 非报道原图
产品动态

OpenAI 将 GPT‑6 推向 ChatGPT 全量用户:新增 Intelligent UI,可直接生成可交互界面

OpenAI 10 月 7 日宣布把 GPT‑6 推向更广泛的 ChatGPT 用户,并引入 Intelligent UI。该能力允许 ChatGPT 在合适的回答中直接组合文本、视觉元素与可交互组件,而不只是返回普通文字;用户无需特殊提示即可触发。OpenAI 表示 GPT‑6 正在全球逐步推出,支持的客户端可在 Instant 到 Extra High 的多个思考档位使用 Intelligent UI;Pro effort 仍由 GPT‑6 Astra 驱动且不使用这一界面能力。此次更新属于 ChatGPT 主体验与 GPT‑6 普及范围扩展,而不是新的 GPT‑6 基础模型训练发布。

资讯时间轴

  1. 57 篇资讯
    1. EasyHub 编辑示意图 · 非报道原图

      OpenAI 将 GPT‑6 推向 ChatGPT 全量用户:新增 Intelligent UI,可直接生成可交互界面

      OpenAI 10 月 7 日宣布把 GPT‑6 推向更广泛的 ChatGPT 用户,并引入 Intelligent UI。该能力允许 ChatGPT 在合适的回答中直接组合文本、视觉元素与可交互组件,而不只是返回普通文字;用户无需特殊提示即可触发。OpenAI 表示 GPT‑6 正在全球逐步推出,支持的客户端可在 Instant 到 Extra High 的多个思考档位使用 Intelligent UI;Pro effort 仍由 GPT‑6 Astra 驱动且不使用这一界面能力。此次更新属于 ChatGPT 主体验与 GPT‑6 普及范围扩展,而不是新的 GPT‑6 基础模型训练发布。

    2. 来源页面配图:Anthropic · 权利归原作者

      Anthropic 发布 Claude Haiku 5.5:短提示 API 价格降 90%,并支持可调 effort 与 Agent 子任务

      Anthropic 10 月 7 日发布 Claude Haiku 5.5,定位高吞吐、成本敏感任务以及更大模型的子 Agent。对不超过 100K token 的提示,输入/输出价格降至每百万 token 0.10/0.50 美元;超过 100K 时为 0.50/2.50 美元。Anthropic 称其平均运行成本较 Haiku 4.5 低约 75%,并首次为 Haiku 系列加入可调 effort。模型现已在 Claude Platform、AWS、Google Cloud 和 Microsoft Azure 上线,模型 ID 为 claude-haiku-5-5;同批更新还把 Sonnet 5.5 cache read 价格减半。

    3. 来源页面配图:LlamaIndex · 权利归原作者

      LlamaIndex 推出 OpenDocRouter:一个 API 路由前沿与开源文档解析模型,统一输出 Markdown 与布局坐标

      LlamaIndex 10 月 7 日上线 OpenDocRouter,把多种前沿模型和开源 OCR/文档模型放到统一 document→Markdown API 下。首批包括 Claude Opus 5.5、Gemini 3/3.8 Flash、GPT-5.6 Terra、GPT-6 Luna,以及 MinerU2.5-Pro、PaddleOCR-VL-1.6 等开源模型;每个模型都通过版本化 recipe 运行并在 ParseBench 上比较质量与成本。API 支持 PDF、PNG、JPEG 与 URL,同步请求最高 50 页,总输入最高 500 页或 50MB,并可用统一 grounding engine 输出 reading order、bounding boxes 和标准化 layout classes。

    4. EasyHub 编辑示意图 · 非报道原图

      Microsoft FORGE 公布规模化 AI 漏洞研究结果:Windows 累计 140 个 CVE,开源项目提交 155 份内部验证报告

      Microsoft Security 的 FORGE Lab 10 月 7 日总结其 AI 原生漏洞研究规模化结果:2026 年 5–9 月间,FORGE 帮助发现并分配了 140 个 Windows CVE,其中 52 个进入 9 月安全更新;团队还向 23 个开源项目提交 155 份内部验证报告,文中称当时已有 93 份在 14 个项目/项目族得到维护者确认或接受。FORGE 使用多模型 Agent 扫描 harness MDASH,并强调真正瓶颈正从“能否找到漏洞”转向复现、验证、修复和维护者审查吞吐。上述数字来自微软自身研究统计,不等于所有报告都已确认成 CVE。

    5. EasyHub 编辑示意图 · 非报道原图

      Microsoft 开放 Surface Laptop Ultra 与 RTX Spark Dev Box 预订:最高 128GB 统一内存,本地运行 120B+ 模型

      Microsoft 10 月 7 日开放 Surface Laptop Ultra 与 Surface RTX Spark Dev Box 预订。两者都围绕 NVIDIA RTX Spark Superchip 构建,最高提供 128GB 统一内存和约 1 petaflop 理论 AI 性能,可在本地运行超过 120B 参数的模型。Surface Laptop Ultra 采用最高 6144 核 Blackwell RTX GPU 与 20 核 Grace CPU,起售价 2599 美元,10 月 16 日上市;Dev Box 起售价 5999 美元,在美国 11 月发货。微软将两款设备定位为本地 Agent、模型评测和开发工作站,并与 MXC/Windows Hybrid Intelligence 配套。

    6. EasyHub 编辑示意图 · 非报道原图

      Microsoft 把 Windows 推向“混合智能”:MXC 正式可用,Windows ML 接入 llama.cpp,并让 HydraFusion 路由本地模型

      Microsoft 10 月 7 日公布 Windows 的 Hybrid Intelligence 路线。Microsoft Execution Containers(MXC)现已在 Windows 11 正式可用,可在运行时限制 Agent 可访问的文件和网络;Windows ML 宣布支持 llama.cpp。微软还将 137B 总参数、6.8B 激活参数的 MAI Code 1.1 Flash 以 3-bit 形式带到本地,并计划让 RTX Spark 本地运行 DeepSeek V4 Flash 与 NVIDIA Nemotron。GitHub HydraFusion 将在 10 月稍晚进入实验预览,把 Copilot App、CLI 和 VS Code 的任务路由到本地或云端模型;Copilot 的本地上下文、动作和模型能力则计划在未来数月逐步推出。

    7. 来源页面配图:Market Logic · 权利归原作者

      Market Logic 将 DeepSights MCP 正式 GA:让 ChatGPT、Claude、Copilot 与企业 Agent 直接调用可引用的市场情报

      Market Logic 10 月 7 日宣布 DeepSights MCP 正式 GA,把企业已整理并带引用的市场情报通过 Model Context Protocol 接给 Microsoft Copilot、ChatGPT、Claude 和自定义 Agent。连接会沿用 DeepSights 的权限与来源/引用可见性,让 Agent 在回答市场问题时直接调用企业认可的研究资料,而不是绕开治理单独抓取外部信息。官方把使用方式概括为 Ask、Review、Orchestrate 三类:直接问答、对文档/计划做研究核验,以及把可信市场情报作为多步骤 Agent workflow 的输入。

    8. EasyHub 编辑示意图 · 非报道原图

      DoiT 与 OpenAI 合作:帮助企业把 OpenAI 工作负载迁到 AWS,并把 AI 成本归因到客户、功能和 Agent

      DoiT 10 月 7 日宣布与 OpenAI 合作,面向企业提供从试点到生产的迁移与成本归因支持。其 OpenAI-to-AWS GenAI Migration Accelerator 会把现有工作负载与 Amazon Bedrock 的功能和区域覆盖逐项映射、并行验证后分阶段迁移,过程可回滚;DoiT Attribute 则把 token、模型与 GPU 成本归因到具体客户、功能或 Agent。DoiT 称其 4000 多家客户的月度 AI 支出两年增长约 100 倍。

    9. EasyHub 编辑示意图 · 非报道原图

      Cisco 在 WebexOne 推出 Agentic Collaboration:Claude Managed Agents 进入 Webex,Dialog 让客服 Agent 跨会话持续执行

      Cisco 10 月 7 日在 WebexOne 2026 发布一组 Agentic Collaboration 更新。Webex 将通过 Claude Managed Agents 让团队在共享企业上下文中分析数据、生成内容和执行工作;Cisco 同时推出 Dialog,作为 Webex AI Agent 平台的新 Agent harness,把零散客服交互连接成持续上下文,并让 Agent 在问题解决前继续代表客户推进任务。同批发布还覆盖 Intelligent Workplace Experiences 和 RoomOS 27 等工作空间能力。这里记录的是协作/客服 Agent 平台升级,不是新的基础模型。

    10. EasyHub 编辑示意图 · 非报道原图

      Cloudflare Agents 0.27.0 发布:新增 Web Search、ContainerHarness,并可在容器中运行 Claude Code 或 Codex

      Cloudflare 10 月 7 日发布 Agents 0.27.0。稳定版新增 AiSdkHarness、ThinkHarness、ContainerHarness 和 OpenCodeHarness,其中 ContainerHarness 可在 Cloudflare Container 中运行 Claude Code、Codex 等 Agent CLI,并用 Durable Object 管理会话、恢复与持久状态;同时新增 agents/websearch,把 Cloudflare Web Search API 暴露为 AI SDK、Pi 和 TanStack AI 可用的 web_search 工具。Channels API 也迁入 experimental/channels,围绕 conversation/turn 重构,并加入 Web Channel、终端 TUI 和多项 MCP、Streams、重连与凭据清理修复。新 harness 与 Channels 接口仍属 experimental,后续可能变化。

    11. EasyHub 编辑示意图 · 非报道原图

      Langfuse 4.54 发布:Trace 可自动归类 Topic,并加入外部媒体存储与结构化 OpenAI Review 输出

      Langfuse 10 月 7 日发布 4.54.0。新版本可把 traces 自动归入不同 topic bucket,方便从大量 Agent/LLM 调用中按主题分析行为;同时加入外部媒体存储集成,session 视图开始使用 trace transcripts,并为 OpenAI review 增加结构化输出。版本还优化 experiment item 与 prompt event 的查询路径、错误可观测性以及多项 session、S3、retention 和可访问性问题。它属于 LLM/Agent 可观测平台的功能版更新,不是新的模型发布。

    12. EasyHub 编辑示意图 · 非报道原图

      Cline 4.1.23 发布:补强异常响应续跑、MCP 大结果分页,并更新 GPT-6.1 Sol 等模型目录

      Cline 10 月 7 日发布 4.1.23。模型响应若缺少可识别的 finish reason,Cline 会先保留部分结果并自动续跑一次,而不是直接当作成功完成;MCP 工具输出超过上下文时,也会保留预览并让 Agent 通过 read_files 分页继续读取,避免截断后的内容直接丢失。版本同时修复通过自定义 Anthropic base URL 使用 Claude 的 400 错误、适配 Kimi K3 等只接受特定 reasoning level 的模型,并刷新模型目录,其中推荐列表加入 GPT-6.1 Sol。模型目录变化属于 Cline 的 provider 配置更新,不代表这些模型在 10 月 7 日首次发布。

    13. EasyHub 编辑示意图 · 非报道原图

      Cline CLI 3.0.69 修复 Windows MCP 启动与企业 Anthropic 网关,并兼容 Kimi K3 的受限 reasoning level

      Cline 10 月 7 日发布 CLI 3.0.69,重点修复真实 Agent 工作流中的兼容性问题:Windows 上通过 npx/uvx 启动的 MCP Server 默认等待时间从 3 秒提高到 10 秒,避免工具静默丢失;自定义 Anthropic base URL(包括 Azure AI Foundry 与企业网关)不再返回 400;Kimi K3 等只接受特定 reasoning level 的模型会自动选择最接近的受支持档位。版本还修复 OpenAI-compatible provider 警告、未知 finish reason 续跑和 config JSON 输出。

    14. 来源页面配图:Silicon Labs · 权利归原作者

      Silicon Labs 将 Simplicity AI SDK 推入公测:Copilot、Cursor、Codex 可直接操作嵌入式 SDK、调试工具和硬件

      Silicon Labs 10 月 7 日把 Simplicity AI SDK 推入公开 Beta,让 GitHub Copilot、Cursor、Codex 等 AI 编程助手以结构化方式访问其 SDK、配置工具、调试环境、文档和连接中的硬件。首批官方支持聚焦 Bluetooth LE,可覆盖项目创建、配置、构建、烧录、调试、网络与功耗分析等工作。公司同时公布 Simplicity Design Intelligence,首个 Hardware Intent 能力计划 2027 年 1 月进入 alpha;开放源码开发者社区 Beta 也从 Bluetooth LE 起步,并将边缘 AI/ML 工具与 Databricks 工作流连接。

    15. EasyHub 编辑示意图 · 非报道原图

      Browser Use 0.13.11 加入 Claude Browser Toolset Driver:为 Anthropic 浏览器工具集提前做好接入

      Browser Use 10 月 7 日发布 0.13.11,新增面向 Claude 的 Browser Use toolsets 与 Anthropic browser toolset driver,并补充审批、远程文件等集成文档。项目明确提醒:这套集成依赖包含 `anthropic.tools.browser` 的 Anthropic SDK,而当前公开 SDK 尚未提供该能力,因此应视为前置兼容而非所有用户已经可以直接启用。版本同时修复敏感数据历史脱敏、Gemini system message、Bedrock 图片 URL 与 MCP 安全开关等问题。

    16. EasyHub 编辑示意图 · 非报道原图

      Google 推出 AI 游戏创作平台 Playground,并与 Unity 预告 Unity Spark:用自然语言生成、修改和分享游戏

      Google 10 月 7 日推出浏览器 AI 游戏创作平台 Playground,美国 18 岁以上用户可通过对话式提示从零或模板创建游戏,不需要编程,并可继续用自然语言修改角色、物理规则和环境后分享或发布到 Explore。Google 同时与 Unity 公布更面向专业 3D 创作的 Unity Spark,计划今年稍晚进入封闭测试,完成的作品也可接入 Playground。报道显示 Playground 会组合 Gemini、Nano Banana、Lyria 等 Google AI 能力;免费层可用,Google One 用户有更高周额度。

    17. EasyHub 编辑示意图 · 非报道原图

      Common Sense 独立评测将 ChatGPT for Teens 评为“不可接受风险”:4000+ 提示测试指向家长告警、危机转介与年龄识别缺口

      Common Sense Media 的 Youth AI Safety Institute 10 月 7 日发布独立评测,将 ChatGPT for Teens 评为“Unacceptable Risk”,并建议 OpenAI 在修复并经第三方验证前将产品限制为 18 岁以上。研究团队在 13–17 岁账号上进行了 4000 多条提示测试,并邀请儿童精神科医生等专家复核。研究称性角色扮演拒绝等部分保护有效,但家长敏感话题告警、危机专业帮助转介、Study Mode 防直接代做作业、拟人化表达和年龄估计仍存在缺口。该结论属于该研究机构的评估,不是监管机构裁定;机构披露其资金同时来自慈善与产业,包括 OpenAI Foundation,并称研究与评级保持编辑独立。

    18. EasyHub 编辑示意图 · 非报道原图

      Biohub 发起 18 亿美元 Virtual Biology Initiative:美国政府、Google DeepMind 等共建开放 AI 生物数据

      Biohub 10 月 7 日公布 Virtual Biology Initiative,计划投入约 18 亿美元,把大规模实验测量与 AI 建模结合起来,生成用于预测细胞行为的生物数据和模型。Reuters 报道称,美国能源部将投入超过 5 亿美元支持实验测量与计算,NIH 参与既有数据标准化,Meta、Google DeepMind、Isomorphic Labs 等私营合作方合计投入约 3 亿美元。项目希望在五年内覆盖数十亿细胞;合作方可在有限期限内优先访问部分新数据,之后数据计划公开。这里记录的是跨机构科研基础设施计划,不把未来药物研发提速写成已经实现的临床成果。

    19. EasyHub 编辑示意图 · 非报道原图

      GitHub Copilot 本地沙箱正式可用:用 MXC 限制 Agent 的文件、网络和凭据访问

      GitHub 10 月 7 日宣布 Copilot 本地沙箱正式可用,覆盖 Copilot CLI、Copilot App,以及通过 Agent Host 运行的 VS Code 会话。沙箱由 Microsoft eXecution Container(MXC)提供底层能力,可限制 Agent 命令访问的文件/目录、互联网与本地网络、Git/GitHub CLI 凭据,并在支持的场景下约束本地 MCP 与语言服务器。企业管理员可以强制开启并下发开发者无法弱化的策略。GitHub 强调模型执行与工具隔离是两件独立的事:无论使用哪个模型,工具调用都受同一套沙箱策略约束。该能力包含在 GitHub Copilot 中,不额外收费。

    20. EasyHub 编辑示意图 · 非报道原图

      GitHub 上线专用泄密检测模型:读取代码上下文识别无固定格式密码,并扩展到 push protection 与 Copilot 安全审查

      GitHub 10 月 7 日发布一款针对 secret detection 微调的专用模型。它读取凭据周围的代码上下文,以识别没有明显 token 格式的密码等潜在泄密,但不会生成代码或自然语言。现有 AI-detected Password alerts 已自动切换到新模型;AI push protection 处于 private preview,Copilot CLI/App 的 `/security-review` 也计划在 private preview 中加入该分类器。现有 GHSP/GHAS 中的 AI secret alerts 继续包含在订阅内,新 opt-in push protection 与 Copilot 检查则计划消耗 AI Credits。GitHub 还计划在 GHES 3.23 中把 AI-detected alerts 带入 public preview。

    21. EasyHub 编辑示意图 · 非报道原图

      CAEVES 发布 Context LAKE:企业数据原地保留,通过 MCP 向 ChatGPT、Claude、Copilot 与私有 Agent 提供受控上下文

      CAEVES 10 月 7 日公布 Context LAKE,并计划 10 月 20 日正式 GA。该产品把索引、上下文化和富化层部署在客户自己的环境内,源数据无需迁移,同时继承现有访问控制,并通过 MCP 向 Microsoft Copilot、Claude、ChatGPT、自定义 Agent 与私有 AI 提供可追溯的上下文。部署范围覆盖公有云、私有云、主权云、本地数据中心和完全隔离环境。

    22. EasyHub 编辑示意图 · 非报道原图

      Teladoc 为 Solo 医疗平台加入 SoloVitals 与 SoloScribe:相机无接触测心率/呼吸率,环境 AI 自动生成临床笔记

      Teladoc Health 10 月 7 日为医院端 Solo 智慧医疗平台新增两项 AI 能力。SoloVitals 通过手机或平板摄像头分析面部皮肤颜色的细微变化,利用远程光电容积描记(rPPG)无接触估算心率和呼吸率;SoloScribe 则在远程就诊过程中生成结构化临床笔记,并把模板化摘要送入 EHR。SoloScribe 已正式可用;SoloVitals 目前向部分客户私有预览,计划 2026 年 12 月全面发布。Teladoc 表示 Solo 已部署在全球 15,000 多个医疗点,并可通过 HL7/FHIR 集成 Epic、Oracle Health 等 EHR。

    23. EasyHub 编辑示意图 · 非报道原图

      O’Reilly 推出 Expert Intelligence:通过 MCP 把具名专家知识、精确引文和任务型 Agent Skills 接入企业 AI

      O’Reilly 10 月 7 日正式推出 Expert Intelligence,定位企业 AI 的知识 grounding layer。它通过 Expert MCP 把 O’Reilly 的从业者知识库接到支持 MCP 的 AI 工具,并用 job-specific Agent Skills 把专家框架转成具体工作流程;回答会返回具名作者、发布日期和可点击到原文段落的引用。官方产品页称连接器为只读,不会主动读取企业系统,提示词和专有数据仍留在客户环境中;founding member 方案采用 12 个月组织级固定费用、全员访问且不按 seat 限制。O’Reilly 自己发布的 60 问 benchmark 只能视为厂商评测,不能当成独立质量排名。

    24. EasyHub 编辑示意图 · 非报道原图

      ClicData 上线 AI Dashboard Builder:一句自然语言生成完整 BI 看板,并可继续用聊天修改图表、筛选与布局

      ClicData 10 月 7 日发布 AI Dashboard Builder。用户把 Agent 指向已有数据表后,用自然语言描述想看的指标,就能生成包含 KPI、图表、筛选和布局的完整 dashboard;之后还能继续通过聊天修改单个或多个 widget、品牌色、过滤条件和整体布局。产品可混合 Google Analytics、Salesforce 等多个数据源,生成的仍是标准 ClicData dashboard,可继续人工编辑和分享。发布稿称该 builder 已可用,并计划后续增加基于用户权限的个性化视图;“每个 dashboard 节省约两小时”等数据来自早期客户/厂商口径。

    25. EasyHub 编辑示意图 · 非报道原图

      ASUENE AIP 上线:30+ AI Skills 把碳排、ESG、供应链与能耗业务编排成企业专属自主 Agent 工作流

      日本 ASUENE 10 月 7 日推出自主型 AI Agent 平台 ASUENE AIP 和配套 AX Consulting。顾问先把企业特有的业务流程、判断标准、规则、系统和数据结构化,再由 AIP 组合目前 30 多个 AI Skills,在封闭环境中执行数据收集、确认、加工、碳排计算、异常值检查、非财务信息管理、报告编制、供应商信息管理与能耗优化等流程。平台还计划强化对 Agent 引用数据、判断过程和实际动作的可追溯性。ASUENE 对“国内累计导入社数 No.1”等市场地位说法来自公司引用的第三方调查,本条不把它作为独立产品性能结论。

      核对 阅读原文
    26. EasyHub 编辑示意图 · 非报道原图

      eDreams ODIGEO 接入 Alexa+:用 MCP 把机票、酒店与租车搜索/预订接进自然语言旅行对话

      eDreams ODIGEO 10 月 7 日宣布与 Amazon Alexa+ 合作,把旅行发现与预订能力接入下一代 Alexa。用户可用自然语言要求 Alexa+ 按偏好查找并预订机票、酒店和租车;集成使用 Model Context Protocol(MCP),让 Alexa+ 调用 eDreams ODIGEO 自有 MCP 网络检索旅行选项,并由 eDreams 处理供应商连接、IATA 许可、金融担保和客户支持等交易基础设施。公司把这称为 agentic distribution 新渠道。公告描述的是合作和集成方向,本条不把它夸大为所有 Alexa+ 用户已经即时获得完整全球预订能力。

    27. EasyHub 编辑示意图 · 非报道原图

      日本 Flyle 获 18.8 亿日元 Series A 并推出 AI Operator:把呼叫中心与 CX 工作拆成多类专用 Agent

      日本 Flyle 10 月 7 日宣布通过第三方增资完成 18.8 亿日元 Series A,累计融资约 22.7 亿日元,并开始提供面向呼叫中心的 AI Operator。公司同时把产品扩展成多 Agent 套件,覆盖 AI VOC 分析、客服质量评价、CX Survey 和 AI Interview 等流程,底层依托处理大量非结构化客户数据的数据平台。资金将用于产品研发与企业客户支持;投资方包括 ALPHA、ALL STAR SAAS FUND、Firstlight Capital、Aflac Ventures Japan、Japan Post Capital、Salesforce Ventures、MUFG Capital、Mizuho Capital 与 SMBC Venture Capital 等。

      核对 阅读原文
    28. EasyHub 编辑示意图 · 非报道原图

      QueryPie 推出桌面 Agent Aru:本地文件、终端、Git、Computer Use 与企业 MCP/Skills 进入同一工作区

      QueryPie AI 10 月 7 日在日本推出 Windows/macOS 桌面 AI Agent「Aru」。它可以在本地工作区里做资料整理、调研、数据分析、文档和开发任务,并把终端、Git、文件查看、内置浏览器、图像生成编辑以及多 Agent 任务分配放进同一界面。Aru 还能通过 Computer Use 读取画面并点击/输入操作没有原生 AI 接口的桌面应用;涉及数据更新或删除等敏感操作时要求用户确认。企业侧可与 QueryPie AIP 同步 MCP、Skills 和组织配置,并连接 Slack、Confluence、Google Calendar、Jira 等系统。Aru Companion 则用桌面角色动画显示 Agent 的进行中、完成和待机状态。

      核对 阅读原文
    29. EasyHub 编辑示意图 · 非报道原图

      Impelsys 在法兰克福书展推出 KAI:用一个“出版超级 Agent”编排 40+ 专项 Agent 覆盖内容全生命周期

      Impelsys 10 月 7 日在 Frankfurt Book Fair 2026 推出 KAI,定位出版行业的 AI super-agent。用户先定义目标,例如新版制作、课程标准对齐或内容就绪审查,KAI 再选择并编排 40 多个专项 Agent,在研究、内容分析、编辑、生产、可访问性、交付与商业化等阶段持续传递上下文。官方称 KAI 构建于 mon'k Fabric,并把作者、编辑、审校等角色放在同一协作环境中。该条记录的是面向出版流程的垂直 Agent 编排产品发布,不把“40+ Agent”理解为 40 个独立通用模型。

    30. EasyHub 编辑示意图 · 非报道原图

      Infinitus 推出 FieldForce:用安全 AI Agent 扩展药企销售与报销团队的医务人员服务能力

      医疗 Agent 通信平台 Infinitus 10 月 7 日推出 FieldForce,一组面向药企现场团队的安全 AI Agent,可分别支持销售代表、现场报销经理或两类角色。FieldForce 主要承担医务人员互动前后和两次拜访之间的研究、产品/处方信息、排期与行政等工作,目标是让现场人员把更多时间留给真正的客户沟通,同时让医务人员在拜访间隙继续获得信息和协助。

    31. EasyHub 编辑示意图 · 非报道原图

      法国 Olyzon 正式上线广告 Agent 编排平台:跨 DSP、库存与测量系统自动调度媒体预算

      法国 Olyzon 10 月 7 日宣布其 Agent 广告编排平台正式上线,并已在真实广告活动中运行。平台从 CTV 起步,现扩展到 YouTube、社交、数字音频和 DOOH,可在 Amazon DSP、DV360、The Trade Desk、Yahoo DSP 等购买端,以及库存与测量合作伙伴之间编排预算、执行和效果反馈。Olyzon 强调 Agent 执行跨系统操作,但媒体买方仍保留预算约束与最终决策权。

    32. EasyHub 编辑示意图 · 非报道原图

      Kore.ai Autoloop 正式 GA:让企业 Agent 围绕完成率、规则、安全、体验和成本持续自优化

      Kore.ai 10 月 7 日宣布 Autoloop 在 Agent Platform Artemis edition 中正式 GA。团队先定义任务完成、准确性/grounding、业务规则、安全、体验、延迟和成本等目标,Autoloop 再持续执行 build、evaluate、diagnose、optimize 与 re-verify;生产环境中的真实交互也会触发新的优化周期。底层 StateTrace 用完整执行上下文追踪 handoff、delegation、state、tool call 和 context,Agent Blueprint Language 则把 supervision、routing、工具、规则与 guardrails 编译为可执行状态机。Autoloop 目前面向所有 Artemis 版客户开放。关于 Kore.ai 自身月均 6500 次 Agent commit 等数据属于公司披露。

    33. 来源页面配图:Beyond Now · 权利归原作者

      Beyond Now 推出通信业 Agentic Revenue 平台:让 CSP 以 Agent 方式组合、销售和计费 AI 服务

      都柏林企业软件公司 Beyond Now 10 月 7 日推出 Agentic Revenue & Ecosystem Orchestration Platform,面向通信运营商和技术服务商,把客户、产品、合作伙伴、定价、订单与服务连接到统一商业层,并通过角色型 Agent 自动化从报价、下单到履约和计费的流程。平台采用无头、模块化、多租户、事件驱动架构,提供开放 API 与 MCP,并允许企业带入自己的 Agent 和模型。

    34. EasyHub 编辑示意图 · 非报道原图

      NTT DOCOMO BUSINESS 启动 Trusted Data Fabric:用 Guardrails、Agent 身份权限和主权数据访问连接企业 AI

      NTT DOCOMO BUSINESS 10 月 7 日启动 Trusted Data Fabric 构想,目标是在企业仍掌握自身数据控制权的前提下,让组织内外 AI Agent 与数据安全协作。架构分为 Trusted AI、Trusted Identity 与 Trusted Data Access 三层:前者计划在 Agent 执行动作前做策略判断并阻断不当操作,后者覆盖 Agent 认证、权限管理、审计和不把数据移出组织边界的访问方式。公司计划在 2026 财年内提供 Action Guardrails,并扩展 SmartLiTA 的 AI Agent 身份/权限能力,同时与金融、医疗、制造、公共基础设施等行业推进应用。这是架构与路线图发布,部分能力仍处于规划或既有服务组合阶段,并非所有功能当天全部 GA。

    35. EasyHub 编辑示意图 · 非报道原图

      Haiqu 发布 AgenticOS:用多组科研 Agent 把量子研究拆成可检查的任务图,并在每一步保留人类复核

      Haiqu 10 月 7 日发布 AgenticOS,面向量子 R&D 团队协调多组科研 Agent,从文献检索、第一性原理推导和量子可行性分析一路推进到实验准备,同时把依赖、决策和产物展示成可检查的研究图。研究人员可以在下游任务继续前审阅假设、重定向模块或锁定关键决定。Haiqu 报告的一项量子化学测试中,10 次独立 Agent 运行有 4 次违反实验设定,而 AgenticOS 按固定 protocol 给出的模拟结果与 exact reference 相差约 3.4%;这些属于厂商案例而非通用独立 benchmark。产品现可由企业 R&D 团队申请使用,学术团队可申请免费计划。

    36. EasyHub 编辑示意图 · 非报道原图

      Danaher 计划 2027 年初运行首个 AI 自主实验室:把分子设计、机器人实验与反馈训练接成闭环

      Danaher 10 月 7 日宣布将在旗下 Abcam 建设首个 AI 驱动的自主实验室,预计 2027 年初规模化运行。系统把 AI 分子设计、机器人构建与测试、结果反馈整合成连续 design-make-test-learn 闭环,用于开发抗体等亲和试剂。公司目标是把从想法到验证试剂的发现速度提升最高 8 倍,并把年度试剂生成量提升最高 10 倍;这些数字属于 Danaher 对未来系统的目标值,并非已经完成的独立实测结果。

    37. EasyHub 编辑示意图 · 非报道原图

      Sereact 双臂 Physical AI 进入 Zalando 真实退货仓:德国、波兰站点无需逐 SKU 训练即可抓取分类

      Sereact、Zalando 与 CEVA Logistics 10 月 7 日宣布,Sereact 的双臂机器人已经在德国 Greven 和波兰 Świebodzin 的 Zalando 退货处理站点进入 live operations。系统由 Sereact Cortex Physical AI 平台驱动,可动态识别、抓取和分类包装状态不一致的退货商品,不要求每个商品预先训练或固定 SKU profile。项目以 Robotics-as-a-Service 交付,是三方扩大欧洲退货自动化合作的第一个正式运营节点;Zalando 此前也作为战略投资者参与 Sereact 的 Series B。

      核对 阅读原文
    38. EasyHub 编辑示意图 · 非报道原图

      AirTrunk 向日本 Inzai 数据中心再投 10 亿美元:部署液冷,把 300MW+ 园区扩展到 AI 工作负载

      Reuters 10 月 7 日报道,Blackstone 支持的 AirTrunk 将向日本千叶县印西市的超大规模数据中心园区追加投资 10 亿美元,用于部署液冷等基础设施并承载 AI 工作负载。该园区容量超过 300MW,过去主要服务传统云负载;AirTrunk CEO Robin Khuda 表示 TOK1 有望成为公司在日本首个大规模部署 AI workload 的园区。此次投资反映的是 AI 基础设施扩容,而不是新的模型或云服务发布。

    39. EasyHub 编辑示意图 · 非报道原图

      AMD 联合韩国 14 家 AI 芯片与基础设施公司:共建异构 AI 计算体系,并推动 ROCm 与全球落地

      AMD CEO 苏姿丰 10 月 7 日在首尔与韩国 14 家 AI 半导体、软件、云与模型企业举行圆桌会议,计划把 AMD CPU/GPU 与韩国 NPU 等本土 AI 芯片组合成异构 AI 计算基础设施,先在韩国验证,再发展成可向全球复制的参考架构。参与方包括 Rebellions、FuriosaAI、HyperAccel、DEEPX、Mobilint、MangoBoost、Panmnesia、Dinotisia、Moreh、Nota AI、Lablup、FADU、Elice Group 与 Upstage,并讨论加入 ROCm 开源生态和海外市场合作。AMD 同时表示将在韩国建立 AI Center of Excellence,并计划招聘数百名研究人员。该合作是此前韩国科技部与 AMD 7 月 MoU 的后续落地。

      核对 阅读原文
    40. EasyHub 编辑示意图 · 非报道原图

      Docling 2.135.0 发布:补齐 Numbers 图表、PPTX 公式、DOCX 页眉页脚与 OCR/HTML/EPUB 解析细节

      Docling 10 月 7 日发布 2.135.0,继续扩充多格式文档解析。新功能包括渲染 Apple Numbers 图表图片并识别 iWork '09 图表类型,以及保留 Markdown 表格单元格里的行内格式;修复项覆盖 PPTX 原生 Office Math 公式与图像占位符、DOCX 偶数页页眉页脚和文本框重复段落、OCR 的 N/A/数字原样保留与置信度、HTML/EPUB 资源路径、PDF 页面尺寸、CMYK 图片等。它不是模型升级,而是面向文档 AI 管线的一次兼容性更新。

    41. EasyHub 编辑示意图 · 非报道原图

      MLflow 3.17 发布:把类型化 Decision/Judge 带进评测、Gateway 与 Trace,并加强共享资源权限

      MLflow 10 月 7 日发布 3.17.0,重点面向 GenAI 评测与可观测性。新版本允许 TypeSafe 模型在内置 scorer 与自定义 judge 中直接输出布尔或类别型反馈,并把相关 Decision 能力贯通 Evaluation、Gateway 与 Tracing;同时给共享资源增加更细粒度权限,可针对 run、trace、version 使用通配授权和显式 DENY。大规模 trace 分析可选用每日汇总降低 SQL 查询开销,评测聚合指标也能关联到对应 managed dataset。需要注意,使用 SQL backend 的服务器升级到 3.17 前需要停写并执行数据库 schema upgrade,不支持混合版本滚动升级。

    42. 来源页面配图:Atlassian · 权利归原作者

      Atlassian 把 AI-native SDLC 推入生产:Code Context 与 Record for Agent 开放测试,DX AI Measurement 正式 GA

      Atlassian 10 月 7 日在 Team ’26 Europe 公布一组 AI-native 软件开发生命周期更新。Code Context 开放 Beta,把跨仓库代码结构与 Jira、Confluence、Loom、Slack、Google Drive 等上下文连接;Record for Agent 也开放 Beta,可把 Loom 录屏和讲解转换成供 coding agent 使用的结构化计划。Jira 现已可接 Cognition Devin、Factory 与 Warp,OpenAI Codex 标注为即将支持。DX AI Measurement solution 同日 GA,可把 AI 使用与吞吐、质量、采用率、摩擦和 ROI 关联,并对单个 Agent session 做评分。Planner、agent loops 与 AI Review 仍处私有早期访问,Agent Sessions 和 Loom Interactive PR Reviews 仍为 closed EAP。

    43. EasyHub 编辑示意图 · 非报道原图

      Weaviate 1.40 发布:Namespaces 转 GA,并加入 RQ-4 量化、HFresh/MUVERA 与默认开启的 Search REST API

      Weaviate 10 月 7 日发布 v1.40.0。Namespaces 正式 GA,用于共享集群中的控制面与数据隔离;删除现有 vector index 也转 GA,可回收不再需要的索引空间。该版本继续优化 HFresh,并加入 HFresh MUVERA 的路由/重排预算解耦、4-bit Rotational Quantization(RQ-4),同时把 Search REST API 从实验开关迁到默认开启,覆盖 hybrid、near-object、near-vector 与聚合计数等接口。官方还加入可选的副本去重备份,并强化异步复制、备份可靠性与安全限制。

    44. EasyHub 编辑示意图 · 非报道原图

      Google Cloud 发布 MCP Toolbox Java SDK 1.0:为企业 Java Agent 提供类型安全的数据工具与认证控制

      Google Cloud 10 月 7 日宣布 MCP Toolbox Java SDK 正式达到 1.0。SDK 面向 Java 企业应用,把 MCP Toolbox 的数据库与工具能力以类型安全方式接入 Agent,并新增默认参数、隐藏 server-bound 敏感参数、MCP 版本与 session 跟踪、自定义企业请求头以及可插拔 CredentialsProvider。官方同时给出 Spring Boot 与 LangChain4j 集成示例,并提醒通过普通 HTTP 传递凭据会带来暴露风险。

    45. EasyHub 编辑示意图 · 非报道原图

      印度 Soket AI 开源 LOOP:面向小时到数天长任务的 Agent harness,支持沙箱、MCP 与共享记忆

      Soket AI 10 月 7 日公开 LOOP(官方产品页写作 Loop),定位可让 Agent 持续运行数小时到数天的开源 Agent harness。官方页面称其采用 MIT 许可证,支持安全沙箱与“infinite loops”;发布报道还描述了 Rust 实现、并行工具执行、MCP、可 fork 的 session、共享记忆与多 Agent 工作流,并把目标场景指向网络安全、金融、法律和国防等需要自托管或隔离环境的任务。Soket 同时在训练 EKA-26B/更大规模推理模型,但这些后续模型仍是路线图,不应和 LOOP 已开源混为一谈。

    46. 来源页面配图:Cloudflare · 权利归原作者

      Cloudflare 把多 Agent 安全调查投入 Managed Defense 早期测试:确定性取证先行,模型只处理受限证据

      Cloudflare 10 月 7 日披露一套已进入 Managed Defense 早期 beta 的多 Agent 安全运营 harness。系统先用确定性代码固定客户范围、收集证据和版本信息,再由 Clef 做轻量分流;需要深度分析的告警会并行交给流量、客户上下文、全局遥测和威胁情报四类 specialist Agent,最后由 synthesis Agent 生成建议。Cloudflare 强调模型不能越过租户边界、不能自行获取未批准证据,也不能替代人工分析员做最终处置;当前 beta 仅面向符合条件的应用安全告警和 case。

    47. EasyHub 编辑示意图 · 非报道原图

      韩国两家大型教会调查疑似 AI 辅助网络攻击:攻击记录出现 sub-agent 与自动化报告痕迹

      Reuters 10 月 7 日报道,韩国汝矣岛纯福音教会与首尔爱之教会正在调查疑似网络攻击。安全公司 Oasis Security 表示,在海外服务器发现的攻击记录中出现“sub-agents”等引用以及看似自动生成的大量攻击报告,显示攻击过程中可能使用了 AI 工具。汝矣岛纯福音教会初步分析称约 85 万名成员相关数据可能受影响。现有证据只能支持“疑似 AI 辅助”,并不能据此确定具体模型、攻击者身份或 AI 在入侵中的实际自动化程度。

    48. EasyHub 编辑示意图 · 非报道原图

      Kaspersky 发布 AI Agent 安全指南:把 LLM 默认视为不可信组件,对不可逆操作要求人工确认并限制工具权限

      Kaspersky 10 月 7 日发布《AI agent security through the lens of Cyber Immunity》指南,把 Cyber Immunity 的 secure-by-design 原则应用到自主 Agent。建议在设计阶段把 LLM 与外部输入默认视为不可信,对不可逆操作要求显式人工确认;缩小 Trusted Computing Base,用沙箱/虚拟机隔离 Agent 与上下文,并对工具调用、参数、网络访问和 Agent 供应链采取 default-deny 控制。指南还建议企业盘点所有 Agent、建立灵活的容器/隔离策略并治理 Agentic supply chain。这是安全研究与架构建议,不是独立证明某种方案能消除 Agent 风险。

    49. EasyHub 编辑示意图 · 非报道原图

      Vijil 推出 Diamond Adaptive Red Team:用自适应攻击 Agent 测试多 Agent 系统,并把证据汇总成可追溯 Trust Score

      Vijil 10 月 7 日发布 Diamond Adaptive Red Team,面向 Agent 和多 Agent 系统做自适应安全/安全性测试。Diamond 会基于 OWASP LLM Top 10、MITRE ATLAS、garak 和内部红队攻击生成 probe,再用校准过的 detector 对响应判定,并把结果聚合到 reliability、security、safety 等维度的 Trust Score;官方产品页强调测试使用版本化 probe、seed 和未用于调参的 held-out ground truth。Vijil 宣称开发阶段可比“领先替代方案”发现最多 1.5 倍的问题,这一数字属于厂商自测,不应视为独立 benchmark。

    50. EasyHub 编辑示意图 · 非报道原图

      Atlassian 披露 AI Forward Deployed Engineering 扩张:现有 46 名工程师,目标 Q3 接近 100 人,已部署 80+ 生产 Agent

      Atlassian 10 月 7 日披露其 AI Forward Deployed Engineering(FDE)项目的扩张情况:团队目前有 46 名工程师,计划到第三季度接近 100 人,覆盖美国、EMEA 与印度;公司称 FDE 已服务 100 多家企业客户并将 80 多个 AI Agent 部署到生产环境。FDE 会直接进入客户环境,从业务目标反推数据、权限、系统连接与 Agent 设计,并把现场经验反馈回 Atlassian 产品团队。Atlassian 明确指出 FDE 角色本身并非今天才发明,该条记录的是项目规模与企业 AI 落地模式的最新披露,而不是“新职业首次发布”。

    51. EasyHub 编辑示意图 · 非报道原图

      营销 AI OS ENSOR 推出 Super Agent:一个请求并行调度专业 Agent,完成图片、视频、LP、分析到发布

      日本 REHATCH 10 月 7 日为营销 AI OS ENSOR 推出 Super Agent。用户从一个请求开始,系统把任务分给图像、视频、LP、数据分析与文档等专业 Agent 并行执行,结果汇总在同一 Canvas 内继续编辑;生成文件可自动保存到 Drive,LP 可直接发布。新功能还支持多人实时协作,以及关闭浏览器后继续后台处理较长任务。它把 ENSOR 过去分散在 AI Edit、LP Edit、Omni Agent、Video Edit 等界面的能力集中成一个统一工作流,属于产品编排层升级,不是新的基础模型。

      核对 阅读原文
    52. 官方项目分享图:Wall Street Journal · 权利归原作者

      Nous Research 融资 9000 万美元:估值达 15 亿美元,推动开源 Hermes Agent 进入企业市场

      《华尔街日报》10 月 7 日报道,Nous Research 融资 9000 万美元、估值达到 15 亿美元,下一阶段将把今年在开发者群体中迅速扩散的开源 Hermes Agent 推向企业客户。Nous 官方将 Hermes 定位为可自我改进的开源 Agent,并强调用户可选择模型、数据位置、记忆策略和运行环境。此次融资反映出开源 Agent 正从个人开发者工具转向企业部署,但企业安全、治理和规模化仍是后续落地门槛。

    53. EasyHub 编辑示意图 · 非报道原图

      IMF 总裁警告 AI 投资热潮带来估值、就业与系统性风险,但治理得当可每年额外贡献约 0.5% 全球增长

      IMF 总裁 Kristalina Georgieva 10 月 7 日在 IMF/世界银行年会前警告,快速扩张的 AI 投资正在形成强劲需求冲击,并可能通过高估值、就业变化、网络安全和金融系统传导带来新风险。她呼吁各国加强技能培训、监管效率与风险治理,同时指出如果 AI 被良好管理,长期可为全球经济增长率每年额外贡献约 0.5 个百分点。Reuters 报道把 AI 风险与能源价格冲击和高债务并列为当前全球增长面临的主要不确定性;这里记录的是 IMF 的宏观风险判断,不是新的 AI 产品或模型。

    54. 来源页面配图:Automation Anywhere · 权利归原作者

      Automation Anywhere 拟收购 Boost.ai:把语音与对话 AI 接入端到端企业 Agent 自动化

      Automation Anywhere 10 月 7 日宣布与 Nordic Capital 达成协议,拟收购企业级对话式 AI 公司 Boost.ai,交易预计在 2026 年第四季度满足监管与惯例条件后完成。Automation Anywhere 希望把 Boost.ai 的语音/对话前台能力与中后台 Agent 自动化连接起来,让客户请求从自然语言交互一路进入业务执行。Boost.ai 官方资料显示其已有 600 个在线 AI Agent 和超过 1.5 亿次自动化对话部署经验。

    55. EasyHub 编辑示意图 · 非报道原图

      财务 Agent 公司 Stuut 获 5250 万美元 Series B:自动执行催收、现金匹配、支付、争议与扣款流程

      Stuut 10 月 7 日宣布完成 5250 万美元 Series B,由 Insight Partners 领投,Andreessen Horowitz 与微软 M12 参与,使累计融资达到 9300 万美元。其 AI Agent 面向企业 order-to-cash 流程,可跨 ERP、银行、销售和支付系统处理催收、现金匹配、支付、争议、扣款等任务;公司称已有 150 多家客户、平台累计处理超过 30 亿美元资金流。Stuut 宣称客户最多可释放 40% 更多现金流、DSO 降低 47%,这些数字来自公司披露,并非独立审计结果。

    56. EasyHub 编辑示意图 · 非报道原图

      Healthleap 融资 3800 万美元:用语言模型读临床笔记,每天筛查住院患者并提示需要进一步评估的风险

      医疗 AI 初创公司 Healthleap 10 月 7 日披露共 3800 万美元融资,包括 Sequoia Capital 与 First Round Capital 共同领投的 800 万美元种子轮,以及 Hummingbird Ventures 领投的 3000 万美元 A 轮。其平台接入医院 EHR,每晚读取实验室结果、生命体征、药物、诊断和临床笔记,并用语言模型抽取体重下降、吞咽困难等概念,再与结构化数据一起形成风险提示,第二天写回护理团队流程。公司称目前已覆盖 50 多家医院;软件用于提示需进一步检查的患者,并不直接做诊断。资金将用于工程、产品、销售和扩展更多病种。

    57. EasyHub 编辑示意图 · 非报道原图

      Providence 与 IBM 用 AI 重构内部招聘:不替换核心 HR 系统,行政工作量称下降 90%

      IBM 10 月 7 日披露与美国医疗系统 Providence 的招聘流程改造。双方没有替换现有核心 HR 系统,而是用 Oracle 专业能力、AI 工程和工作流编排把内部转岗流程连接起来。IBM/Providence 报告,招聘经理的行政工作量下降 90%,内部员工平均提前 12 天进入新岗位,转岗成本下降 60%,流程准确率最高提升 70%。这些数字来自合作方案例,不能视为独立审计。Providence 每年约一半招聘活动来自内部转岗,该项目的重点是让 AI/自动化嵌入现有流程,而不是新增一个独立聊天机器人。

  2. 135 篇资讯
    1. EasyHub 编辑示意图 · 非报道原图

      ChatGPT 支持直接上传音频文件:可转写、总结并把会议或访谈整理成结构化笔记

      OpenAI 10 月 6 日在 ChatGPT Release Notes 中加入音频文件上传。用户可把受支持的录音直接附到对话中,让 ChatGPT 生成转写、摘要、问答、会议/访谈/课程笔记或后续邮件草稿。该功能目前面向付费 ChatGPT 订阅与工作区,实际可用性仍取决于工作区设置、地区、客户端版本和所选模型;OpenAI 同时提醒转写可能出错,不同语言的表现也可能存在差异。

    2. EasyHub 编辑示意图 · 非报道原图

      Atlassian 与 OpenAI 扩大合作:GPT-6 系列进入 Rovo 与企业 Agent,3000 多名 Atlassian 开发者已使用 Codex

      Atlassian 与 OpenAI 10 月 6 日宣布扩大合作,新协议将 GPT-6 系列前沿模型用于 Atlassian 平台和 Rovo 中的 Agent。Rovo 把 OpenAI 模型与 Atlassian Teamwork Graph 结合,让 Agent 获取项目、文档、人员和决策等企业上下文;OpenAI 同时披露已有 3000 多名 Atlassian 开发者在终端、IDE 和 code review 工作流中使用 Codex。协议还扩大 Atlassian 对 GPT-6 Astra 与 GPT-5.6 系列的访问,并通过 Teamwork Graph 插件让 ChatGPT/Codex 连接 Jira、Confluence 等工作信息。

    3. EasyHub 编辑示意图 · 非报道原图

      OpenAI“Next Economy”平台首篇独立文章提出:先进 AI 的关键瓶颈可能从“发现”转向“执行能力”

      OpenAI 10 月 6 日上线“Next Economy”系列首篇文章《The eternal complement》。作者 Hemanth Asirvatham 与 Elliott Mokski 认为,现代科研与技术进步越来越受实验、工程、组织、供应链和制度执行能力约束;先进 AI 可能不仅提升前沿洞见,也会大量用于代码、文献检索、原型、协调与其他“把想法变成现实”的常规执行工作。文章讨论了未来可能出现偏“深度”或偏“广度”的两种文明路径,并强调人类好奇心仍有独立价值。作者明确注明:文章仅代表个人观点,不代表 OpenAI 或其同事的官方立场。

    4. EasyHub 编辑示意图 · 非报道原图

      OpenAI 公开内部 frontier model 的一批数学新结果:GitHub 发布论文并用 Lean 形式化验证多项证明

      OpenAI 10 月 6 日公开一批由内部 frontier model 产生的数学新结果,并把论文与持续修订、引用规则发布到 GitHub。为提高可核验性,仓库同时公开多项证明的 Lean 形式化版本,并披露 10 份模型推理摘要、尝试问题数量统计和计算量估计;OpenAI 称最终采用的结果平均约使用相当于三小时 ChatGPT Pro thinking 的计算量。此次发布重点是把此前内部数学进展转成可由研究社区检查和引用的材料,并不等同于正式向公众开放产生这些结果的模型。

    5. EasyHub 编辑示意图 · 非报道原图

      OpenAI 与 Ironclad 把合同工作流变成 Agent 训练任务:Astra 在 11 项研究评测中得分高 32%、模拟耗时低 48%

      OpenAI 10 月 6 日公布与合同管理平台 Ironclad 的研究合作,把 NDA、采购审批、可复用条款更新等 11 类真实专业工作流改造成 Agent 训练与评测任务。官方研究评测中,GPT-6 Astra 平均 rubric 得分为 55.0%,高于 GPT-5.6 Sol 的 41.6%,估算每次尝试时间从 37.0 分钟降至 19.2 分钟。OpenAI 明确说明这些结果只覆盖 11 个研究任务,时间也是模拟估算,并不代表全部 Ironclad 工作流或真实客户节省时间。

    6. 来源页面配图:Anthropic · 权利归原作者

      Claude 进入 Google Docs、Sheets 和 Slides 公测:侧边栏可直接改文件、写公式与创建幻灯片

      Anthropic 10 月 6 日将 Claude for Google Workspace 推入公测,Pro、Max、Team 与 Enterprise 用户可通过 Marketplace 扩展,在 Docs、Sheets、Slides 侧边栏直接读取并修改当前文件。Claude 可在 Sheets 写/修公式和清洗数据,在 Docs 重写长文,在 Slides 新增或调整页面;每次修改保留在 Google 版本历史中。它与 Claude 聊天里的 Google Workspace connectors 不同:这个扩展是让 Claude 进入你正在打开的文件。

    7. 来源页面配图:OpenAI · 权利归原作者

      OpenAI Decisions API 转入公测:Luna 直接输出真假概率、固定选项置信度与数值评分

      OpenAI 10 月 6 日 20:53 UTC 宣布 Decisions API 向所有开发者进入 public beta。该 API 由 GPT-6 Luna 驱动,接受文本和图像输入,但不是自由文本聊天接口,而是针对有限决策空间输出三类结构化结果:Predicates 用概率判断陈述是否成立,Choices 从预定义选项中选择并给出置信度,Scores 则按数值区间评分。OpenAI 称在其测试中,这类决策请求相较通过 Responses API 使用 GPT-6 Luna 最多可快 10 倍;该数字属于厂商性能声明,并非跨供应商独立基准。

    8. EasyHub 编辑示意图 · 非报道原图

      OpenAI API 将五档付费用量层级简化为三档:Build、Launch、Grow,最高档门槛降至累计 500 美元

      OpenAI 10 月 6 日更新 API 用量层级,将原有五个付费 tier 简化为 Build、Launch 与 Grow 三档。官方开发者社区说明,新最高档 Grow 的累计 API 付款门槛为 500 美元,低于此前最高档所需的 1000 美元;已处于付费层级的组织会自动迁移,无需手动操作。OpenAI API changelog 同步确认该调整,并提示开发者继续按各模型的 rate limit 与月度 usage limit 查看实际配额。此次变化属于账户与速率配额体系调整,不是模型价格下调。

    9. EasyHub 编辑示意图 · 非报道原图

      报道称 DeepSeek 接近完成至少 800 亿元融资,腾讯与宁德时代据称为主要出资方;公司尚未确认

      Reuters 10 月 6 日转述 Bloomberg:DeepSeek 据称接近完成至少 800 亿元人民币(约 119 亿美元)融资,腾讯与宁德时代被报道为主要出资方之一;最初目标约 500 亿元,在投资需求推动下最终规模可能接近 1000 亿元。需要特别注意,这不是 DeepSeek 官方融资公告:Reuters 明确表示无法独立核实,DeepSeek、腾讯和宁德时代当时均未立即回应。本站因此按“融资报道/传闻”记录,不将金额或参与方写成已确认事实。

    10. 来源页面配图:Anthropic · 权利归原作者

      Anthropic 将 Pro/Max 新 Cowork 任务默认迁到云端:本地专用开关移除,旧本地任务不受影响

      Anthropic 帮助中心确认,从 10 月 6 日起,Claude Pro 与 Max 用户新建的 Cowork 任务改为在 Anthropic 云端运行,“Only on your computer”选项被移除;此前已经在本机启动的任务仍留在本地并可继续完成。云端 Cowork 可在关闭笔记本后继续运行,定时任务不再依赖设备在线,并支持桌面、Web 与移动端之间延续同一任务。这是执行位置与任务连续性的变化,不是 Claude 基础模型升级。

    11. EasyHub 编辑示意图 · 非报道原图

      Google 发布 Nano Banana 2.1:基于 Gemini 3.6 Flash,强化 4K 图像、文字渲染、多图一致性与搜索 Grounding

      Google DeepMind 10 月 6 日发布 Nano Banana 2.1 模型卡,并在 Gemini API / Google Cloud 文档中将 `gemini-nano-banana-2.1` 标为 GA。它是基于 Gemini 3.6 Flash 的高效率图像生成与对话式编辑模型,支持 1K、2K、4K 输出,改进宽幅图像伪影、文字与信息图排版、多轮角色一致性和多图融合;最多可使用 14 张参考图,并可通过 Google Web 与 Image Search 做 grounding。模型输入可包含文本、图像、视频和 PDF,输出为图像与文本。

    12. EasyHub 编辑示意图 · 非报道原图

      Claude Code 2.1.292 发布:Agent 可指定 effort,插件安装扩展 marketplace,并集中修复沙箱、文件读取与权限绕过问题

      Anthropic 10 月 6 日发布 Claude Code 2.1.292。功能上,Agent tool 新增 effort 参数,插件安装可通过 --marketplace 自动添加来源后安装,mods 获得 prompt caching 与更多 hook 能力;本地 MCP 默认协商 2026-07-28 协议版本。安全修复覆盖 UNC 网络路径读取权限、审批文件在读取过程中被链接替换、server-managed settings 缓存篡改、managed sandbox deny path 变化、插件 hook/permission 重启期间的绕过等问题。版本还修复大量 cloud session、routine、scheduled task 与 Remote Control 稳定性问题。

    13. 来源页面配图:Anthropic · 权利归原作者

      Anthropic 扩大 Cyber Verification Program:三档权限开放 Opus 5.5、Sonnet 5.5 与 Mythos 5.1 的高级网络安全能力

      Anthropic 10 月 6 日扩展 Cyber Verification Program(CVP),把此前的 CVP 与 Project Glasswing 合并成 Defense、Red Team、Specialized 三档访问。各档均可申请使用 Claude Opus 5.5、Sonnet 5.5、Mythos 5.1 及后续模型,但验证要求与网络安全拦截强度不同。Anthropic 称 Glasswing 合作方在 4–7 月确认了至少 12.9 万个软件漏洞,其自身扫描到 10 月又确认约 5500 个;其中超过 3.3 万个被评为高危或严重。上述数字来自 Anthropic 与合作方统计,应视为项目方披露而非独立审计。

    14. 来源页面配图:Anthropic · 权利归原作者

      Anthropic 扩大 Claude Startups:新创可获一年 Claude Team、1000 美元 API credits 和最高 4.5 万美元合作伙伴优惠

      Anthropic 10 月 6 日扩大 Claude Startups 计划。获批团队如果此前未使用 Claude Team,可获得最多 5 个 Premium 席位的一年免费 Team、1000 美元 Claude API credits,以及来自合作伙伴的最高 4.5 万美元工具优惠,并可参加 Applied AI office hours、Founder House、hackathon 等活动。官方说明该计划面向过去 5 年内成立或过去 2 年内获得融资的初创团队;部分合作 VC 支持的公司还可经投资方获得额外 API credits。

    15. EasyHub 编辑示意图 · 非报道原图

      OpenAI 将 GPT-6 Astra 与 GPT-6.1 Sol 默认推理速度提高约 50%,Codex/Work 与第三方登录生态同步受益

      量子位 10 月 6 日援引 Codex 负责人 Thibault Sottiaux 当日公开更新称,OpenAI 已把 GPT-6 Astra 与 GPT-6.1 Sol 的默认推理速度提高约 50%,默认速度达到约 50 tokens/s。更新覆盖官方订阅中的 Codex/Work,也包括通过 Sign in with ChatGPT 接入的第三方生态。该变化属于服务端推理与容量优化,不是新模型版本或 Ultrafast 档位发布;量子位同时指出,此前 GPT-6.1 Sol 上线初期曾因负载增长出现明显变慢。

    16. 报道配图:Bloomberg · 权利归原作者

      彭博:Moonshot AI 据悉以约 500 亿美元估值完成最后一轮私募,并筹备 2027 年一季度香港 IPO

      彭博 10 月 6 日援引知情人士称,月之暗面(Moonshot AI / Kimi)已完成上市前最后一轮私募融资,估值约 500 亿美元,并正为 2027 年第一季度香港 IPO 做准备;公司据悉最快本月开始通过 early-look meetings 测试投资者兴趣,潜在 IPO 融资规模最高可能达到 50 亿美元。报道同时明确,这些安排仍在讨论中、细节可能变化,消息来自匿名知情人士而非 Moonshot 官方公告,因此本站将其记录为可信媒体报道的融资/上市计划,而不是已确认完成的 IPO。

      核对 阅读原文
    17. EasyHub 编辑示意图 · 非报道原图

      Gemini CLI v0.63.0 发布:加强长 Agent Loop 内存控制,并支持非交互模式自动执行 Plan

      Google 于北京时间 10 月 7 日凌晨发布 Gemini CLI v0.63.0。稳定版限制长时间 Agent loop 的工具输出大小并优化内存生命周期,改进连接恢复提示、MCP 配置错误区分、后台 shell 临时目录清理和路径/策略校验;其中最值得注意的是非交互模式现在可以自动执行已生成的 plan。该版本以可靠性与自动化改进为主,不是新的 Gemini 基础模型。

    18. EasyHub 编辑示意图 · 非报道原图

      Anthropic 在澳大利亚议会听证中表示愿讨论 AI 公司事故披露义务,并称企业数据删除规则限制事故可见性

      Anthropic 10 月 6 日在澳大利亚议会相关听证中表示,不认为其产品曾入侵澳大利亚政府系统,但愿意讨论要求 AI 公司披露数据泄露或网络事故的法律。公司同时称,企业客户的数据删除与隐私设置会让模型提供方对客户侧事故可见性更低。听证还涉及版权与生成式 AI 训练数据争议;本条只记录 AI Agent 安全责任和事故披露部分,不把未经证实的政府入侵说法写成既成事实。

    19. EasyHub 编辑示意图 · 非报道原图

      Mistral 预览 Large 4「Le Chonk」:计划 10 月 27 日开放权重,先向安全专家与政府机构提供测试访问

      Mistral 10 月 6 日公布新模型 Mistral Large 4,内部昵称“Le Chonk”。Reuters 报道称,模型目前处于预览阶段,部分网络安全专家和政府机构可先访问一个安全限制更少的版本做能力测试,完整公开计划在 10 月 27 日进行,并将以开放权重形式发布。Mistral 称 Large 4 在编程、金融、地理空间分析、制造与产品设计等任务上缩小与前沿模型的差距;CEO Arthur Mensch 还宣称其在部分网络安全能力上优于一些中国开放权重模型,但没有给出具体对手和测试细节,因此本站不把这句话当作独立验证的排名结论。

    20. 来源页面配图:Google · 权利归原作者

      Google 发布 EmbeddingGemma 2:740M 参数把文本、代码、图像、视频和音频统一到端侧嵌入空间

      Google DeepMind 10 月 6 日发布 EmbeddingGemma 2。该 Apache 2.0 开放模型基于 Gemma 4,总规模 740M 参数,把文本、代码、图像、视频与音频映射到统一的 768 维嵌入空间;模块化架构允许文本/代码场景只加载约 270M 参数,并按需加入视觉和音频编码器。官方给出的 Pixel 11 Pro 量化内存示例约为文本模式 191MB、完整多模态 567MB,并把上下文扩展到 8K,可用于端侧搜索、RAG、媒体检索和 routing。Google 的基准领先描述属于其官方评测,应与独立第三方排名区分。

    21. EasyHub 编辑示意图 · 非报道原图

      Perplexity 发布 pplx-decider-v1.1-27b:Decision Index 升至 61.56,价格降到 v1 一半

      Perplexity 10 月 6 日发布开放权重多模态决策模型 pplx-decider-v1.1-27b。官方称新版本在 Hugging Face Decision Index 0.3 上总体得分从上一代的 56.4 提升到 61.56,同时输入价格降至每百万 token 0.02 美元、约为 v1 的一半。模型仍基于 Qwen3.8-27B 系列骨干,主要变化包括解除 causal mask 并扩大训练数据。Decision Index 和性能提升数据均来自官方/平台基准,应视为特定评测结果而非通用能力排名。

    22. 来源页面配图:Hugging Face · 权利归原作者

      Hugging Face Diffusers 0.41.0 发布:完整接入 Qwen-Image 2.1,并加入 LTX-2.5 DFR、Cosmos 3 与更省内存的并行加载

      Hugging Face 10 月 6 日发布 Diffusers 0.41.0,重点把 Qwen-Image 2.1 的文生图、图像编辑、原生透明 RGBA 和 LoRA 训练带入 Diffusers。版本还增加 tensor-parallel checkpoint 分片直读以降低加载峰值内存、LTX-2.5 DFR keyframe/时空细化 pipeline、Cosmos 3 SeaCache 与量化支持,以及 Krea 2、MiniMax-H3 单文件加载;同时宣布弃用内置 ONNX 支持,ONNX Runtime 工作流建议迁往 Optimum。

    23. 来源页面配图:Bubble · 权利归原作者

      Bubble 发布 Agent 2 与 Bubble MCP:AI 建站 Agent 全量上线,并允许 Claude Code/Codex 直接改 Bubble 应用

      Bubble 10 月 6 日让 Agent 2 结束 Beta 并向所有 Web/移动应用开放,同时推出 Bubble MCP 公测。Bubble 称 Agent 2 在内部评测中更准确、更可靠,并把预览固定到编辑器内;MCP 则允许 Claude Code、Codex 或其他 Agent 直接操作已有 Bubble 应用,例如根据 Linear/Jira ticket 实现功能、根据设计稿生成页面或修复支持工单。当前 MCP 仍不能读日志、合并分支或部署,且使用自带 Agent 时不消耗 Bubble AI credits。

    24. EasyHub 编辑示意图 · 非报道原图

      Promptfoo 0.124.0 发布:接入 Claude 5.5、GPT-6 系列与 Grok 4.7,并把多项 Provider 依赖改为按需安装

      Promptfoo 10 月 6 日发布稳定版 0.124.0。新版本扩展了 Claude Opus 5.5、Claude Sonnet 5.5、GPT-6 Sol/Luna、Grok 4.7、GPT-6.1 Sol/ultrafast 等 Provider 支持,并加入 OpenAI safety identifiers、TypeSafe Jev provider、Claude server-tool 恢复与 coding agent 隔离工作区等能力。与此同时它包含一批 breaking changes:OpenAI Agents、Codex Security、浏览器 SDK、WatsonX、Langfuse、Slack 和本地 Transformers 等依赖改为显式/按需安装,并移除 hosted ChatKit provider。这里记录的是 Promptfoo 的集成与评测工具更新,不代表这些外部模型在 10 月 6 日首次发布。

    25. EasyHub 编辑示意图 · 非报道原图

      Precisely 上线 AI Studio 并扩展 MCP:现成 Apps、Agents 与 Skills 可连接 Claude、ChatGPT 和 Copilot

      Precisely 10 月 6 日上线 AI Studio,提供经过整理的 Apps、Agents 与 Skills,让开发者以现成样例构建数据质量、地理编码、治理流程、复制管道等 AI 工作流,并可与 Claude、Microsoft Copilot 和 ChatGPT 配合使用。同日,Precisely 还宣布为多款产品提供 MCP Server 支持,把数据清洗、地址验证、SAP 自动化、主数据、客户沟通等能力暴露给兼容 MCP 的 Agent,而不要求客户重新编写一套定制集成。AI Studio 已立即开放,部分 MCP 能力会在随后数月分阶段提供。

    26. EasyHub 编辑示意图 · 非报道原图

      Oracle APEX 26.2 正式发布:AI Agent 接入 OpenAI Responses/Gemini Interactions,并把数据权限下沉到数据库

      Oracle 10 月 6 日宣布 APEX AI Application Generator 26.2 本地部署立即 GA,Autonomous AI Database 与多云版本随后推出。新版 AI Services 支持 OpenAI Responses 兼容 API、Google Gemini Interactions 与 OCI Generative AI,并新增 Reasoning Effort。AI Agent 可导航到开发者允许的应用页面,最终签名 URL 由可信应用代码生成;Deep Data Security 则让 Agent 工具执行的 SQL 继承请求用户身份,在数据库层按行、列和值控制访问,避免“问 Agent 更多”就自动扩大数据权限。

    27. EasyHub 编辑示意图 · 非报道原图

      Swarms Marketplace 扩展 MCP:自动检查服务器工具与认证,并生成 Claude、Cursor、VS Code 连接配置

      Swarms 10 月 6 日扩展 Marketplace 的 MCP 支持。发布者只需粘贴 MCP Server URL,Marketplace 会尝试连接服务器、读取其暴露的工具并识别认证要求,再生成面向 Claude、Cursor、VS Code 等 MCP 客户端的连接配置。对于无需认证的服务器,流程可进一步简化安装;需要 API key 的服务则会展示相应的配置方式。此次更新主要降低 MCP Server 的发布与消费门槛,不代表 Marketplace 对第三方服务器的安全性作独立背书。

    28. EasyHub 编辑示意图 · 非报道原图

      Google 与 Constellation 签长期核电合作:新增 890MW 核电增容,并用 Gemini Enterprise 优化电站规划与运营

      Google 与 Constellation 10 月 6 日公布长期能源与技术合作。20 年 PPA 将支持 Constellation 在 6 座现役核电站、11 台机组上投资升级,在 2032 年前为 PJM 电网增加 890MW 新的核电出力;另有 15 年能源供应协议覆盖约 2700MW 既有核电能力。双方还将部署 Google Cloud 与 Gemini Enterprise Agentic workflows,用于增容规划、建设、发电优化以及更广泛的能源运营。应注意,3.59GW 是两类协议合计规模,真正“新增容量”是 890MW。

      核对 阅读原文
    29. 来源页面配图:Hugging Face · 权利归原作者

      Transformers 5.19 发布:加入 EmbeddingGemma 2、多模态嵌入支持,并强化 MoE Expert Parallel 与连续批处理

      Hugging Face 10 月 6 日发布 Transformers v5.19.0。新版本加入 Google EmbeddingGemma 2 支持,可把文本、图片、音频和视频映射到统一 768 维向量空间,并支持 Matryoshka 截断到 512、256 或 128 维。框架侧还新增 Expert Parallel token dispatch,并将其用于 Qwen3 MoE 等模型;Trainer 适配 Expert Parallel,连续批处理扩展到常规 SDPA/Flash attention,同时引入逐层 cache 配置。版本包含多项 breaking changes,升级时需检查 MoE router logits 与 paged attention 行为。

    30. 来源页面配图:Retool · 权利归原作者

      Retool 推出中央化 Agent Harness 早期访问:把员工 Agent 放进 Slack、Teams 与 Google Chat,同时统一管控工具和权限

      Retool 10 月 6 日开放新的中央化企业 Agent Harness 早期访问,让员工直接在 Slack、Microsoft Teams 和 Google Chat 中使用个人 Agent,同时由企业统一控制可用模型、工具和数据。Agent 运行在中央托管的沙箱中,也可部署到企业自己的 VPC;工具调用经过模型外部的策略网关,每个 Agent 有独立虚拟服务账号和审计身份,可追踪动作、输入输出与 token 成本。Retool 明确不让这套 Agent 直接访问员工笔记本,也不提供浏览器自动化或桌面控制;公司称已内部使用四个月,并正向下一批约 100 家客户滚动开放。

    31. EasyHub 编辑示意图 · 非报道原图

      HG Insights 发布 Contextual Intelligence Platform:Fabric、Copilots、Agents 与 MCP Server 共用一套 GTM 上下文

      HG Insights 10 月 6 日推出 Contextual Intelligence Platform,把市场、账户、买方、技术栈、支出、意向等数据连接为 Fabric,并提供 HG Copilots、HG Agents 与 HG MCP Server。HG Agents 可从 Slack、Teams、HG 界面或 MCP 调用;HGSuperagent 会按请求选择专门 Agent 并组合带来源的结果。平台当天开始提供,按 Intelligence Credits 计量,Copilot 模块起价为 2.2 万美元。产品性能、效率与营收影响均属于厂商主张,本站不把它们当独立基准。

    32. 来源页面配图:FlashML / FreeVideo · 权利归原作者

      FreeVideo v0.2.4 发布:MiniMax H3 本地视频生成优化参考图/视频编码,并提供 Windows 与 Apple Silicon 安装包

      FlashML 10 月 6 日发布 FreeVideo v0.2.4。该项目让用户在本地硬件上运行 MiniMax H3 视频生成,v0.2.4 将带参考图和参考视频的 prompt 编码从 FP32 改为 BF16,并按实际素材长度预留显存、对长参考分块编码;项目称此前在 16GB 显卡上会卡住的“15 秒参考视频 + 3 张图”场景现在可在一分钟内完成编码。版本同时改进 Windows 共享显存回退、自适应重试和最长 15 秒参考音视频截取,并提供 Windows 10/11 NVIDIA 与 macOS 14+ Apple Silicon 安装包。

    33. EasyHub 编辑示意图 · 非报道原图

      Lambda 据报拟在 2027 IPO 前再融资最高 40 亿美元,投前估值 145 亿美元

      NVIDIA 支持的 AI 云公司 Lambda 据《华尔街日报》及 Reuters/TechCrunch 10 月 6 日报道,正寻求在计划中的 2027 IPO 前完成最高 40 亿美元融资,投前估值约 145 亿美元,由 Coatue 与 Blackstone 领投。报道援引投资者材料称,其 backlog 从 6 月约 150 亿美元增至 9 月约 500 亿美元,其中很大一部分来自 Anthropic 的约 350 亿美元承诺。Lambda、Coatue 与 Blackstone 当时未立即回应 TechCrunch,因此这应写成“正在融资/据报”,不是已完成交易。

      核对 阅读原文
    34. EasyHub 编辑示意图 · 非报道原图

      OpenBMB 新建 MiniCPM‑V 4.7‑35B‑A3B 模型仓库:16 个权重分片已公开,但模型卡、许可与基准说明仍缺失

      OpenBMB 在 Hugging Face 于 10 月 6 日 18:36 UTC 新建 `openbmb/MiniCPM-V-4.7-35B-A3B` 公共模型仓库。当前仓库已经包含 16 个 safetensors 权重分片、模型索引、tokenizer、processor 与 generation/config 文件,API 元数据显示仓库非 private、非 gated,配置架构为 `MiniCPMV4_7ForConditionalGeneration`。但截至本次核验,仓库没有 README、没有 cardData,也没有 license、pipeline tag 或 library metadata,因此本站只记录“官方模型仓库与权重对象已公开”这一事实,不据仓库名推断实际参数激活方式,也不引用第三方性能或许可结论。

    35. 来源页面配图:Technology Innovation Institute · 权利归原作者

      阿联酋 TII 发布 Falcon‑Emirati‑7B:在 Falcon‑H1‑Arabic 上专门适配阿联酋方言、文化语境与口语表达

      阿联酋 Technology Innovation Institute 10 月 6 日公布 Falcon‑Emirati‑7B,一款基于 Falcon‑H1‑Arabic 7B 的方言专门化模型。团队混合原生阿联酋方言网页、关于当地文化与身份的现代标准阿拉伯语资料,以及受词表和风格规则约束的合成方言数据,并用原生说话者人工评估、Alyah 1,173 题基准和 LLM-as-judge 做验证。TII 报告该模型在自家评测中对阿联酋方言忠实度和文化理解领先所比较模型,但这些结果来自团队自己的基准与评估流程;官方也提醒罕见表达、地方化知识和高风险场景仍需单独验证。

    36. 来源页面配图:Technology Innovation Institute · 权利归原作者

      TII 发布 2.7 亿参数 Falcon OCR Arabic:SFT+RL 适配阿拉伯文档,自建基准文本准确率 81.87%

      Technology Innovation Institute 10 月 6 日公布 Falcon‑OCR‑Arabic,在原有 2.7 亿参数 early-fusion Falcon OCR 架构上进行两阶段阿拉伯语适配:先用真实与合成文档监督微调,再对高质量样本做强化学习。团队构建了 11,974 个真实文档、15 类场景的内部基准,并报告 81.87% 文本准确率、59.95% Table TEDS;在其 17 模型比较中总文本准确率仅次于 Gemini 3.5 Flash。TII 也明确列出弱项:报纸、杂志、漫画等复杂页面差距更大,手写文本仍落后 Gemini。所有排名都应视为厂商在自建基准上的结果,而不是独立通用排行榜。

    37. EasyHub 编辑示意图 · 非报道原图

      TwelveLabs 发布 Pegasus 1.6:原生理解第一视角视频,并把图片分析与 Physical AI 数据标注纳入同一 API

      TwelveLabs 10 月 6 日发布 Pegasus 1.6。新版开始原生理解可穿戴摄像头、遥操作机器人等第一视角视频,并支持单次请求分析 1–20 张图片;同时改进人物与物体识别、元数据提取、分段内时间戳事件和长视频分段。官方文档给出的上下文窗口为 261,120 token,视频最长可直接分析 2 小时。TwelveLabs 将第一视角能力明确指向机器人与 Physical AI 的动作标注、质量检查和下一动作预测。

    38. 来源页面配图:Plaid · 权利归原作者

      Plaid 发布 Instant Link 与 LendScore 2:用现金流和网络数据做下一代信贷风险评分

      Plaid 10 月 6 日发布 Instant Link 与 LendScore 2。Instant Link 允许消费者预先授权 Plaid CRA 在后续信贷申请中提供现金流与网络洞察,Plaid 称贷款方可在不到两秒内取回授权结果,无需用户每次重新连接银行账户。LendScore 2 则扩展为多个信贷风险模型,包括核心 Ls2、汽车/短期/住房专用版本,以及首个 transformer-based LendScore Arc。Plaid 称 Ls2 相比只使用传统信用数据具有 42% 更高 predictive power;这些提升数字来自 Plaid 自己的测试,应按厂商评测理解。

    39. 来源页面配图:TechCrunch · 权利归原作者

      Underdog 开放邀请测试:个人 AI 全程本地运行,Husky 推理引擎面向 Mac 与 Windows

      Conway Research 创始人 Sigil Wen 的个人 AI 产品 Underdog 于 10 月 5 日进入邀请测试,并在 10 月 6 日由 TechCrunch 报道。Underdog 当前在 Mac 与 Windows 上把模型、记忆和主要推理放在本机运行,Linux、iPhone 与 Android 版本计划后续推出;其自研 Husky 推理引擎重点减少 CPU/GPU 之间的数据搬运。TechCrunch 还称,用户授权的邮箱等账户密钥会加密保存。该产品目前免费且无广告,长期商业模式仍在探索中。

      核对 阅读原文
    40. EasyHub 编辑示意图 · 非报道原图

      MegazoneCloud 发布 AIR Studio v3:把 Data、Agent、Ops、Governance 拆成模块,并集中管控 MCP、密钥与 Token 成本

      韩国 MegazoneCloud 10 月 6 日发布企业 AI OS「AIR Studio v3」。新版本把能力拆为 Data、Agent、Ops、Governance 四个可独立采用的模块,企业可以先处理数据、Agent 构建、运维或治理,再逐步扩展。其自研 AI Gateway 把模型、Agent、MCP 与外部工具调用集中到一个控制点,支持虚拟密钥、防止原始认证信息暴露、审计日志和绕过 API 调用阻断;FinOps 仪表盘还能按组织、用户角色和职级分配 Token 上限与预算,并实时估算成本。韩媒还报道平台内置 70 多种预认证连接器。

      核对 阅读原文
    41. EasyHub 编辑示意图 · 非报道原图

      Flagship Pioneering 投入 2000 万美元成立 iris labs:首款 iris chat 通过 iMessage/RCS 做个人 AI“思考伙伴”

      Flagship Pioneering 10 月 6 日宣布成立 iris labs,并提供初始 2000 万美元资金承诺。首款产品 iris chat 定位为个人 AI“thought partner”,通过 iMessage 与 RCS 对话,随持续交流学习用户的经历、优先事项和目标。官方称系统使用专家指导与 AI judges 做质量循环,并为每次对话并行运行一个安全 Agent,实时判断何时需要额外保护。iris chat 面向“心理适应力/个人福祉”场景,不能等同于医疗、心理治疗或临床服务。

    42. 来源页面配图:Aqua Voice · 权利归原作者

      Aqua Voice 登陆 Android:悬浮语音按钮可在任意输入框直接听写,并用语音原地改写文本

      Aqua Voice 10 月 6 日正式发布 Android 版并上架 Google Play。Android 版本不替换用户原有键盘,而是在 Gboard、三星键盘等上方提供悬浮 Aqua 按钮;用户在任意输入框点击后说话,完成的标点化文本会直接写入当前应用。Edit 功能还能让用户选中文字后用语音下达“改成列表”“缩短”等修改指令。Android 版继续使用 Aqua 自研 Avalon 1.5 语音识别模型,支持 49 种语言,并使同一账户覆盖 Mac、Windows、iPhone 与 Android。

    43. EasyHub 编辑示意图 · 非报道原图

      Crunchbase 发布 Crunchbase AI:用 MCP、LLM 与 API 把私募市场数据直接送进 Agent 工作流

      Crunchbase 10 月 6 日发布 Crunchbase AI,把其私募市场数据与预测做成面向 Agent、LLM 和产品开发者的“无头情报层”。通过 Crunchbase MCP,Agent 可以查询公司财务、Firmographic、融资、投资者活动、竞争格局和预测,并保留结果来源;MCP 可接入 ChatGPT、Claude、Perplexity 等兼容环境。开发者也可以通过 API 把实时更新的公司与市场数据嵌入自己的产品、内部尽调 Agent、评分模型与 BI 流程。Crunchbase 表示其数据库覆盖 600 多万家公司。

    44. EasyHub 编辑示意图 · 非报道原图

      S&P Global 扩展 ChatIQ:把多源问答、筛选、图表、Excel 建模与 PPT 生成带进 Capital IQ Pro

      S&P Global 10 月 6 日更新 Capital IQ Pro,把 ChatIQ 更深地嵌入金融研究工作流。新版可在单一对话中跨公司、市场、信用、宏观数据以及财报、新闻和研究材料进行问答、筛选和图表分析;ChatIQ Spreadsheets 增加带可刷新 Capital IQ 公式的 Excel 建模助手,ChatIQ Presentations 则在 Labs 中用平台数据生成 PowerPoint 页面。它是专业金融数据平台的 AI 工作流升级,不是通用聊天机器人发布。

    45. EasyHub 编辑示意图 · 非报道原图

      Pinterest 推出 Beauty Guides:用视觉理解与生成式 AI 把发型、染发和美甲灵感图转成可执行方案

      Pinterest 10 月 6 日在美国 iOS 上线 Beauty Guides,把发型、发色、美甲形状与质感类 Pin 转成个性化操作指南。系统先用 Pinterest 的视觉理解识别图片细节,再结合大语言模型生成在沙龙应该怎么描述、预计流程与时间、价格区间、维护方式、相似造型、相关产品和在家复刻步骤。用户在支持的 Pin 详情页点击 Get the Guide 即可使用并保存。Pinterest 表示之后会扩展到更多用户、地区和产品类别;目前不是全平台、全球同步上线。

    46. EasyHub 编辑示意图 · 非报道原图

      个人 AI Agent 撞上网站反爬墙:Amazon 阻断 Muse,Meta 联合 Walmart、Stripe 等推进商业 Agent 开放标准

      TechCrunch 10 月 6 日报道,随着 Muse、Instinct、Dots 等个人 Agent 开始代用户购物和订票,传统反爬与反机器人机制正在成为新的兼容性障碍。Amazon 已阻断 Meta Muse 访问其零售站点;Walmart 则表示其并非有意封锁 Muse,但人类验证流程可能让 Agent 失败。报道还披露 Meta、Walmart、Stripe、Sierra、Genesys、Rocket、NiCE 与 Decagon 等已开始推动一个开放标准,用于让可信 Agent 与商家在在线商业场景中通信,并区分代表用户行动的 Agent 与恶意自动化流量。该标准仍处推进阶段,并非已经完成或普遍部署。

    47. EasyHub 编辑示意图 · 非报道原图

      Incognia 推出 AI Agent Detection:金融机构可识别 Agent 发起的交易行为,并结合设备、位置与账户风险判断是否需要人工确认

      Incognia 10 月 6 日推出 AI Agent Detection,面向金融机构识别由 AI Agent 或自动化环境发起的购买、支付、账户修改等行为,并把 Agent 身份信号与设备、位置、账户历史、网络风险等信息结合,评估某次动作是否真的得到用户授权。公司同时扩展 Web Behavioral Biometrics,并推出 MCP Server,把风险情报接入兼容的 AI 调查工具。Incognia 特别强调“识别出这是合法 Agent”并不等于“用户授权了这次具体操作”。

      核对 阅读原文
    48. EasyHub 编辑示意图 · 非报道原图

      Mysten Labs 与 Google Cloud 公布 Verifiable Agent Arbiter:把 Agent 明细留在企业云中,完整性证明锚定到 Walrus 与 Sui

      Mysten Labs 10 月 6 日与 Google Cloud 公布 Verifiable Agent Arbiter(VAA),定位为企业 AI Agent 的可验证证据层。提示词、模型输出、工具调用和策略决策等详细遥测保留在客户控制的 Google Cloud Storage,系统只把记录完整性的密码学证明写入 Walrus 并由 Sui 协调。VAA 还面向跨公司的 A2A Agent 交易提供争议回放,并可记录 x402/Agent Payments 的授权、支出决定和服务交付。双方称初始企业部署会先于更广泛可用。

      核对 阅读原文
    49. EasyHub 编辑示意图 · 非报道原图

      Aembit 把企业 IAM 扩到个人 AI Agent:Agent 与员工采用混合身份,按请求签发短期凭证并可独立撤销

      Aembit 10 月 6 日宣布现有客户可直接对个人 AI Agent 使用身份与访问控制,无需新增部署或额外费用。系统给 Agent 分配独立身份,同时保留其代表的员工身份上下文,在每次访问时综合 Agent、用户、资源和条件执行运行时策略,并签发短期、限定范围的凭证。安全团队可集中审计并单独撤销某个 Agent,而不用停用员工账号;策略既可通过 Aembit MCP Identity Gateway 执行,也可结合现有网关。

      核对 阅读原文
    50. 来源页面配图:Infor · 权利归原作者

      Infor 扩展 Industry AI:把行业 Agent、Agentic Orchestrator、流程挖掘与自动化装进新一代 Velocity Suite

      Infor 10 月 6 日扩展 Industry AI 架构与 Velocity Suite,增加个性化自适应体验、新治理模型和更多行业 Agent。Velocity Suite 把 Industry AI Agents、Agentic Orchestrator、流程挖掘、自动化、预置行业用例、GenAI 与实施服务组合成单一方案。同期调查由 YouGov 代表 Infor 于 2026 年 8 月执行,覆盖 7 个市场 2111 名业务决策者;“通用 AI 不够贴合行业”的结论属于厂商委托研究,应保留这一边界。

      核对 阅读原文
    51. EasyHub 编辑示意图 · 非报道原图

      BioRender 推出 Leo 科学绘图 Agent:先问需求、再给草图,最终生成可逐元素编辑的科研图

      BioRender 10 月 6 日上线 Leo,一款专门面向科研图示的 AI Agent。Leo 不直接从 prompt 跳到最终图片,而是先询问受众、目的和表达要求,再给研究者可批注的草图,确认后才在 BioRender 画布上构建正式图。生成结果中的标签、箭头、图标和形状仍是独立可编辑对象,研究者可局部修改而无需整图重生成。BioRender 表示 Leo 当天起向所有 BioRender 用户开放。

    52. EasyHub 编辑示意图 · 非报道原图

      ServiceTitan 扩大 Max Agentic OS:住宅承包商全面可用,并推出 Atlas 手机端与面向 AI Agent 的 Homh 预订平台

      ServiceTitan 10 月 6 日在 Pantheon 2026 宣布,AI 驱动的 Max 套餐现已向所有住宅入户服务承包商开放,并对商业与屋面承包商启动有限试点。Max 作为其 Agentic Operating System 的完整版本,可跨获客、现场与后台上下文协调工作流。公司同时推出 Atlas 移动 App,让老板可直接在手机上询问销售、收入和业务变化;还发布 Homh 消费者需求平台,让消费者或他们使用的 AI Agent 发现、比较并直接预订 ServiceTitan 承包商。Homh 支持 ChatGPT、Gemini 与 Claude,并向 Agent 暴露实时可用性与已确认预约。

      核对 阅读原文
    53. 来源页面配图:GoodData.AI · 权利归原作者

      GoodData.AI 推出 Agentic Serving Plane:在企业数据与 AI Agent 之间增加统一语义、权限和执行层

      GoodData.AI 10 月 6 日发布 Agentic Serving Plane,定位于企业数据平台与仪表板、应用、助手和自主 Agent 之间的统一治理执行层。它把查询服务、业务语义、上下文 grounding、访问控制和 AI 执行放进同一层,用于应对 Agent 连续产生大量短生命周期查询的高并发负载;权限可细到字段、行和租户,并通过 GoodData MCP Server 向 Agent 暴露同一套受治理指标与业务上下文。公司还预告未来数月逐步加入 Local Inference,让部分 AI 能力更靠近客户控制的数据运行。

    54. 来源页面配图:Realtor.com · 权利归原作者

      Realtor.com+ 上线 RealAssist AI for Agents:自动整理客户活动、生成搜索,并在人工确认后执行下一步

      Realtor.com 10 月 6 日把 RealAssist AI 扩展到面向房地产经纪人的 Realtor.com+ 工作区。新层包含三类核心能力:根据客户偏好和备注自动建立更定制的房源搜索;把聊天、搜索、通知和价格变化汇总为 Daily Digest 并给出下一步建议;以及 Agentic Actions,可基于 MLS 字段优化搜索或按经纪人口吻起草客户消息。官方强调 Agent 只推荐并协助执行动作,最终仍由经纪人审核批准。Realtor.com+ 目前已覆盖 21 个市场和超过 19.2 万名经纪人。

      核对 阅读原文
    55. EasyHub 编辑示意图 · 非报道原图

      OpenHands 1.25.0 发布:Model Router 可首轮自动运行,Automation 接入原生 Git,并加入语音输入与 Agent Profile 人设

      OpenHands 于 UTC 10 月 6 日 00:56(北京时间 08:56)发布 1.25.0。新版本扩展 Model Router,可用 direct-prompt 配置并选择在 conversation start 自动运行;Automation 在云后端显示模板并提供原生 Git integrations。聊天输入新增可选语音听写,Agent Profile 可从 server catalog 选择全部工具并配置自己的 persona/额外指令,Canvas Apps 支持更新动作,workspace 文件发现也可配置。它是一轮面向 Agent 编排、自动化和交互体验的稳定版更新。

    56. EasyHub 编辑示意图 · 非报道原图

      富士通上线零售 AI Agent 试验环境:四类 Agent 覆盖销售分析、会员洞察、MD 规划与店长支持

      富士通 10 月 6 日开始提供面向零售业的 AI Agent 试验环境,并将与 7 家零售企业分阶段开展实证。首批四类 Agent 分别负责销售结构分析、顾客忠诚度分析、销售/MD 规划和店长支持,统一运行在配套执行平台上,并通过 Uvance for Retail 提供。目标是把数据分析、经营措施制定与门店决策串成可执行的 Agent 工作流,而不是单纯增加聊天助手。

    57. EasyHub 编辑示意图 · 非报道原图

      ServiceNow 上线 AI Workflow Factory:把流程挖掘、Agent 构建和 App Engine 串成持续优化闭环

      ServiceNow 10 月 6 日在孟买发布 AI Workflow Factory 与 Autonomous Engineer。AI Workflow Factory 把 Process Mining、Autonomous Engineer / Build Agent 和 App Engine 串成持续改进闭环:先发现应该优化的流程与 KPI,再由 AI 帮助构建工作流和 Agent,并在平台上运行、继续根据结果发现下一轮改进点;AI Control Tower 负责治理 Agent、工作流和决策。AI Workflow Factory 当天全球可用,Autonomous Engineer 则为申请制 Early Access。

    58. EasyHub 编辑示意图 · 非报道原图

      CXApp 推出 Beat Beta:主动寻找卡住的工作,并在用户批准后直接执行下一步

      CXApp 10 月 6 日发布 Beat Beta,一款从“回答问题”转向“推动工作流前进”的 Agent。Beat 会读取工作队列中的待办和上下文,寻找因 Ticket、Pull Request、消息或会议后续而停滞的工作,准备下一步动作,并在用户批准后直接在团队已经使用的系统中执行。首批目标用户是工程师、开发者、产品经理和创始人,后续计划扩展到销售与管理层工作流。

    59. EasyHub 编辑示意图 · 非报道原图

      Orgvue 开放 WebMCP:让受信任 AI Agent 直接调用组织设计与 workforce planning 工具

      Orgvue 10 月 6 日宣布 WebMCP interface 上线,把一组预构建工具通过 Web Model Context Protocol 暴露给客户认可的 AI Agent。Agent 可以在 Orgvue Workspace 内调用组织设计、workforce planning 和影响分析能力,同时维持既有权限、审计与治理边界。Orgvue 官网已把 WebMCP 作为产品能力展示,定位是让企业在不把人员规划逻辑搬出受控系统的情况下接入外部/内部 Agent。

    60. 来源页面配图:CreditNirvana · 权利归原作者

      CreditNirvana 发布 ORCA 与 CognifAI Assist:200+ Agent 编排催收,并用语音 + 屏幕协作辅助贷款流程

      Perfios 旗下 CreditNirvana 10 月 6 日发布 ORCA 与 CognifAI Assist。ORCA 用 200 多个专用 AI Agent 在数字、语音、呼叫、上门和法律渠道之间做账户级催收策略编排,在贷款方设定目标、限制和人工审核边界后持续“决策—执行—观察—调整”;CognifAI Assist 则把多语言语音 Agent 与可视化 co-browsing 结合,用于 re-KYC、贷款申请和服务流程。公司宣称可降低 40% 催收成本、提高 30% 接通率,并让 60–70% 催收旅程自动完成,这些均为厂商自报指标。

    61. EasyHub 编辑示意图 · 非报道原图

      Sapiens 推出保险业 AI 基础 Sapiens Brain:用领域知识图谱与 MCP 为 Agent 提供可审计上下文

      Sapiens 10 月 6 日发布 Sapiens Brain,作为保险行业 Agent 平台 SapiensAIP 的领域知识基础。它把 Sapiens 数十年的保险产品、文档、设计资料和业务逻辑组织成互联的领域记忆/知识结构,用于给模型提供保险术语、规则与监管上下文;核心保险系统再通过 MCP 暴露给 SapiensAIP Agent。公司还表示 Agent 的决策与推理链会记录用于审计。官方使用“减少 hallucination 与 drift”等表述属于厂商设计目标,不应写成已被独立证明能消除幻觉。

    62. EasyHub 编辑示意图 · 非报道原图

      Jeppesen ForeFlight 部署首批航空运营 AI Agents:从机组排班到航班中断恢复,保留人工最终决策

      Jeppesen ForeFlight 10 月 6 日在巴黎商业航空用户大会上公布 ForeFlight Airflow 的首批商用航空 AI Agents,把今年 7 月发布的 agentic AI 平台推进到实际运营场景。首批能力覆盖 Trip Trading、Target Mastery 与 Augmented Ops Control,可辅助机组排班、配对优化以及天气或空管中断后的飞机与机组恢复方案。公司表示客户可使用 Jeppesen 自有 Agent、第三方工具或自建 Agent,并自行决定自动化程度;所有建议都基于航空数据与运营方规则,保留事实、来源和推理链供人工复核。

    63. EasyHub 编辑示意图 · 非报道原图

      Caseware Verity 风险 Agent 全球上线:读取财务、控制与文档生成审计风险草案,结论仍需审计师确认

      Caseware 10 月 6 日全球上线 Verity 驱动的 Risk Suggestion Agent,并把它纳入现有 Verity 许可、无需额外付费。Agent 会综合本期与往年财务信息、已有风险、控制措施和选定文档,为具体审计项目生成风险建议和初稿,但任何建议都必须由审计人员独立审阅后才能接受、编辑或写入项目。Caseware 同时把 Disclosure Checklist Agent 扩展到英国,该 Agent 可从财务报表生成带理由与来源引用的披露清单建议。公司表示项目数据不会被用于训练 AI 模型。

    64. EasyHub 编辑示意图 · 非报道原图

      Atlassian 推出 AMP:让 AI Agent 以可归属身份、共享上下文和受限权限加入 Jira/Confluence 团队协作

      Atlassian 10 月 6 日在 Team ’26 Europe 公布 Agentic Multiplayer Protocol(AMP),把 Agent 从一对一聊天工具变成团队工作中的可见参与者。AMP 围绕协作、身份/共享存在和上下文/治理三层设计:Agent 可在 Jira、Confluence、Loom 等流程中被 @、接收结构化 brief、拥有明确 owner 与独立身份,并继承或获得受限权限;本地 IDE/终端中的 Agent session 也可接回 Jira。Atlassian 表示 AMP 已开始滚动上线,同时扩展 MCP Server、Teamwork Graph 和 Agent identity 管理。

    65. 来源页面配图:Gradient Ventures · 权利归原作者

      Zeroset 走出隐身:Nebula 为长程企业 Agent 建“状态层”,获 520 万美元 pre-seed

      Zeroset 10 月 6 日走出隐身,并披露由 Gradient Ventures、2048 Ventures 等支持的 520 万美元 pre-seed。首款产品 Nebula 不只做相似文本检索,而是追踪企业工作流中的实体、时间、冲突、归属与来源,把跨 Microsoft 365、Outlook、Teams、SharePoint、GitHub 等系统的操作历史整理为 Agent 可查询的当前状态与工作流轨迹。官方将其定位为长程企业 Agent 的上下文/状态基础设施,而不是新的基础模型。

    66. 来源页面配图:Business Wire · 权利归原作者

      Siena 获 1700 万美元 Series A:从客服 Agent 扩张为消费品牌统一“Agent of Record”

      Siena 10 月 6 日宣布完成 1700 万美元 Series A,由 York IE 领投,累计融资达到 2970 万美元。公司从最初的 AI 客服 Agent 扩展为所谓“Agent of Record”:让面向客户的 Agent、内部 Agent 与人工团队共享同一客户上下文和情报层。其现有平台覆盖客服、社交互动、商品推荐、QA、知识和 Agent 构建等场景。该融资用于扩展这套消费品牌 Agent 基础设施,而不是发布新的基础模型。

    67. EasyHub 编辑示意图 · 非报道原图

      AlphaSense 推出 SuperAnalyst:把金融与战略研究从问答升级为持续执行、自动刷新的分析 Agent

      AlphaSense 10 月 6 日发布 SuperAnalyst,定位为面向金融与企业战略人员的常驻分析 Agent。用户给出目标后,Agent 会自行拆解计划、检索并核对证据、进行计算、编写和执行代码,再生成投资备忘录、财务模型、对比表、监控面板和董事会演示等成果;相关输出还能随实时数据变化持续刷新。AlphaSense 强调其架构会保留可审计证据链,并尽量减少不必要的检索、模型调用和算力开销。这是 AlphaSense 市场情报平台上的 Agent 产品升级,不是新的基础模型。

    68. 来源页面配图:Business Wire · 权利归原作者

      Polygrade 走出隐身并获 630 万美元:用多 Agent 自动处理保修理赔从报案到承包商付款

      Polygrade 10 月 6 日走出隐身并披露 630 万美元融资,投资方包括 Construct Capital、American Family Ventures 与 Nine Four Ventures。平台面向保修理赔,使用按任务拆分的 Agent 覆盖首次报案、分诊、授权、零件采购、发票和承包商付款等环节,并在异常情况再转人工。Polygrade 官方称其并非单一通用模型,而是一组针对理赔生命周期不同阶段的专用 Agent,可叠加在现有保修管理系统之上。

    69. EasyHub 编辑示意图 · 非报道原图

      Tulip 把 AI Agent 带进工厂现场:连接机器、视觉与操作员数据,并原生支持双向 MCP

      Tulip 10 月 6 日在 Operations Calling 2026 公布一组面向制造现场的 AI 与数据能力。工程师和操作员可围绕实时机器、视觉和人员数据构建应用、Agent 与自动化;Factory Playback 把边缘摄像头和视觉语言模型变成可回放的生产历史,并新增人员活动检测;Composable AI Agents 扩大到更多现场流程。Tulip 还宣布原生 MCP Connectors,可让外部 AI/编码 Agent 在权限和审计约束下读写 Tulip 应用、表和工作流,也允许 Tulip Agent 调用外部系统。部分能力仍处客户测试或 Preview,不能写成全部已经 GA。

    70. EasyHub 编辑示意图 · 非报道原图

      Cognitum One 发布 ruOS:给企业 AI Agent 提供可控 Linux 工作区、持久任务上下文与多 Agent 协调

      Cognitum One 10 月 6 日发布 ruOS,定位为企业和软件厂商为 AI Agent 提供“自己的电脑”的执行层。官方发行稿称,ruOS 提供托管工作区、持久任务上下文、Agent fleet 协调和企业基础设施集成,组织可自行选择模型与助手界面,并定义任务运行位置与访问控制。公开 ruOS 仓库还提供 computer-use MCP 接口,可让兼容客户端控制屏幕、键鼠、Shell 与系统动作。产品当天可用;这是 Cognitum 自己的产品定位和能力说明,并非独立性能评测。

    71. 来源页面配图:Every · 权利归原作者

      Every 推出 Slack 内置的 Every Agent:把复杂任务委派、团队 AI 实验与模型更新提醒放进同一个协作 Agent

      Every 10 月 6 日推出 Every Agent,一款常驻 Slack 的团队协作 Agent。成员可以直接把复杂工作委派给它,把个人已经验证有效的 AI workflow/skill 分享给同事,并通过 Frontier Alerts 在新模型或工具发布时获得结合团队实际工作方式的个性化提醒。Every 还表示对底层模型 token 不加价,用户支付其实际模型成本。该产品重点不是再做一个聊天机器人,而是让 AI 工作流在团队公开频道中被复用和扩散。

    72. 来源页面配图:Teledyne FLIR · 权利归原作者

      Teledyne FLIR 发布 Prism A-ISR:在无人机端实时做地面目标检测、分类与多目标跟踪

      Teledyne FLIR OEM 10 月 6 日发布 Prism A-ISR,作为 Prism 软件组合中的新嵌入式模块,面向无人机和其他空中 ISR 平台,在设备端对地面目标进行实时检测、分类与多目标跟踪。它可处理被动中波红外、长波红外与可见光 EO 数据,并结合降噪、超分辨率等图像处理降低带宽压力。官方产品资料显示软件已面向 NVIDIA Orin 和 Qualcomm 8550 等边缘计算平台部署。这里记录的是公开商业软件发布,不涉及具体军事行动或操作指导。

    73. 来源页面配图:Hark · 权利归原作者

      Hark Pro 正式上线:免费开放 Web、iOS 与 Android,用记忆与云端电脑主动处理个人事务

      Hark 10 月 6 日正式上线 Hark Pro,面向所有用户免费提供 Web、iOS 与 Android 版本。产品会保存用户允许的长期记忆,并通过自有云端电脑 Handoff 登录网站、并行操作浏览器,还可连接 Google、Outlook、文件、外部数据库与 MCP 服务。Hark 把它定位为会主动发现下一步需求的“personal intelligence”,例如安排停车、补充账户余额或处理购买任务。官方称基础功能永久免费,Pro² 与 Pro³ 分别以每月 20 美元和 100 美元提供 2 倍与 10 倍用量;隐私与自动执行能力仍属于厂商承诺,需要结合实际权限设置使用。

    74. EasyHub 编辑示意图 · 非报道原图

      Zetaris Cloud 发布 AI Data Harness:让 Agent 原地查询分散企业数据,不先做集中式 ETL

      Zetaris 10 月 6 日宣布推出 Zetaris Cloud 与 AI Data Harness,目标是让 AI Agent 直接在原位置查询企业分散的结构化、非结构化和流式数据,而不必先把数据集中搬入单一仓库。官方称该服务与云、数据平台和模型供应商解耦,并把现有安全、访问与策略控制带到 Agent 的数据访问路径中。厂商还宣传显著 TCO 降幅,但属于内部测算,因此本站不把该数字作为独立验证结论。

    75. EasyHub 编辑示意图 · 非报道原图

      Dell 扩展 AI Data Platform:用统一语义层、企业知识图谱与 Knowledge Agents 给 Agent 补企业上下文

      Dell 10 月 6 日公布 AI Data Platform 新路线:Unified Semantic Layer 统一结构化与非结构化数据的业务定义,Enterprise Knowledge Graph 用元数据、血缘和查询历史映射关系,Knowledge Agents 则在受限数据切片上为特定主题提供上下文。三项能力计划在 2027 年上半年发布,并非现在已经 GA。同期 Dell 还宣布 Data Processing Engine 将引入 NVIDIA cuDF,内部测试称平均约为纯 CPU 的 3.9 倍、特定批处理最高 20.4 倍;这些为 Dell 自测,相关 GPU 加速计划 2026 年 12 月可用。Storage Performance Tool 和部分 AI-ready data services 已经可用。

    76. 来源页面配图:ElevenLabs · 权利归原作者

      ElevenLabs 推出 ElevenAgents Architect Alpha:从对话数据找根因、自动改 Agent、跑模拟后交给人工批准

      ElevenLabs 10 月 6 日推出 ElevenAgents Architect Alpha,把一个内置“Agent 专家”加入 ElevenAgents。它可以跨大量真实对话找出问题根因,修改知识库、Prompt、Workflow、语音、Guardrail、工具和模拟配置,并把改动先生成成可版本化草稿;系统还会运行模拟验证,再由团队决定是否上线。Architect 也能从 Spotlight 发现接手调查,并可通过 Claude、Claude Code、ChatGPT、Cursor 与 Grok Bot 等外部工具访问当前 Agent 上下文。Alpha 期间并非所有工作区都会立即看到全部界面。

    77. 来源页面配图:Upstage · 权利归原作者

      Upstage 发布新一代 Studio:把文档抽取升级为可编排 Agent 工作流,连接合同、发票与业务记录

      韩国 Upstage 10 月 6 日发布新一代 Upstage Studio,把智能文档处理从单次 Parse/Extract 推进到可设计、部署和运营的 AI 文档工作流。官方发布称 Studio 可把分散的合同、发票和交付记录连接起来,用于发现多付、少收或遗漏等业务异常;产品页进一步提供 Agent Editor、Agent Library、Parse、Classify、Extract、Instruct、人工复核与 Quick Tune 等能力,并支持 REST API。产品页把 connectors、MCP 与 Webhooks 标为 coming soon,因此这些连接能力不能写成已经全部可用。

    78. EasyHub 编辑示意图 · 非报道原图

      Sarvam 将 Bulbul V4 接入 Voice Agents:每个 Agent 可切换 V3/V4,并加入可筛选试听的语音目录

      印度 Sarvam AI 10 月 6 日更新 Voice Agents:Bulbul V4 现在与 Bulbul V3 并存可选,用户可在每个 Agent 上选择版本;voice picker 同时升级为可筛选目录,可浏览、试听和筛选声音。Sarvam 还为 Bulbul V4 的声音加入更描述性的显示名称,例如把 Shubh 标为 Hinglish Ad Voice、Ritu 标为 Hindi Support Agent,并提供 V3 到 V4 的名称映射。这是 Voice Agents 的产品接入与语音选择更新,不是当天首次发布整个 Bulbul V4 模型家族的宣称。

    79. 来源页面配图:Cursor · 权利归原作者

      Cursor iOS 上线 Remote Control:手机可查看和回复电脑上的本地 Agent,任务仍在本机运行

      Cursor 10 月 6 日上线 Remote Control,用户可从 Cursor iOS 查看电脑上正在运行的本地 Agent、打开具体任务并发送消息。该功能不会把 Agent 迁到云端,任务仍在原电脑运行,因此电脑必须保持开机、联网;桌面端还提供 Keep this computer awake。Remote Control 默认对个人用户开启,Enterprise 组织默认关闭,由管理员在安全设置中决定是否启用。

    80. 来源页面配图:AgentMail · 权利归原作者

      AgentMail 上线 AgentID:让 AI Agent 用独立邮箱身份通过 OIDC 登录应用,并关联可追责的人类所有者

      AgentMail 10 月 6 日正式上线 AgentID,把它定位为“给 AI Agent 的 Sign in with Google”。每个 Agent 可使用自己的 AgentMail 邮箱作为稳定身份,通过标准 OpenID Connect 登录支持 AgentID 的应用;应用既能识别 Agent 本身,也能知道它对应的人类所有者。AgentMail 表示 AgentID 可接入 Clerk、Supabase、Auth0、Better Auth、Auth.js 等标准 OIDC 栈。该方案解决的是 Agent 身份与授权,不代表应用必须授予 Agent 与人类用户相同权限。

    81. EasyHub 编辑示意图 · 非报道原图

      Google 研究用 AI 解读“盲扫”产前超声:让非专科医护采集简单扫描并离线估算孕周与胎位

      Google 10 月 6 日介绍其产前超声研究:先培训医护人员进行更简单的“blind sweep”超声扫描,再由机器学习模型从采集结果估算孕周与胎位,降低对专业 sonographer 的依赖。Google 将方案定位于资源不足地区,强调设备可便携、模型可离线运行。该工作仍属于研究与临床验证方向,不应写成已经替代标准产科超声或独立完成诊断。

    82. EasyHub 编辑示意图 · 非报道原图

      Mirror Particle 构建“人类行为世界模型”:不靠 LLM 扮演人群,尝试直接预测消费者行为变化

      旧金山初创公司 Mirror Particle 10 月 6 日公开其“human behavior world model”路线,目标是从头训练一个随时间建模人群动机与行为变化的基础模型,而不是主要依赖 LLM 通过提示词或微调去扮演目标人群。公司称训练和推理会结合客户数据、时事、流行文化、社交媒体等,并更重视真实行为而非自报问卷。当前商业落点是市场研究、品牌与产品策略;公司已经完成天使轮,并称正接近完成首轮机构融资。其效果主张目前主要来自公司和早期试点,仍需独立验证。

      核对 阅读原文
    83. EasyHub 编辑示意图 · 非报道原图

      Soilytix 发布 LOAM 基因组 AI 模型:用 1.56 万个环境微生物基因组训练,面向土壤作物保护候选发现

      德国 Soilytix 10 月 6 日发布 LOAM 系列基因组 AI 模型,并同步公开研究预印本和四个研究用途模型。官方称训练数据来自 15,640 个由土壤、沉积物和水体长读长测序重建的微生物基因组,总计约 675 亿个 DNA 碱基。LOAM 用于基因必需性、酶功能和遗传变异效应等任务,并被接入公司的 bio-asset discovery 流程,用来从环境 DNA 中缩小可能具备作物保护价值的基因和蛋白候选范围。官方 benchmark 结果属于厂商/作者自己的评测,本站不把其领先结论扩展为通用模型排名。

    84. EasyHub 编辑示意图 · 非报道原图

      XtalPi 发布 Kodexia:用生成式 AI、第一性原理建模和自动化实验闭环设计 siRNA,并公布 6 个自研项目

      晶泰科技 XtalPi 10 月 6 日发布 Kodexia siRNA 发现平台,把序列设计、化学修饰、体内外实验、肝外递送设计与知识产权策略放进统一计算—实验闭环。公司同时公布 6 个自研临床前项目,并称其中领先的 IgA 肾病项目从启动到获得非人灵长类有效性数据用了 7 个月。XtalPi 还公布近 3 倍设计效率和首轮体内命中率超过 50% 等内部数据,这些指标属于公司自报,尚不能当作跨平台独立基准。

    85. 来源页面配图:JetBrains · 权利归原作者

      JetBrains 提出 AI 生成代码三层审查框架:先看整体风险,再到文件分层,最后检查高风险代码片段

      JetBrains Research 与 Lund University 研究者 10 月 6 日公布一套面向 AI 生成代码的审查框架。研究基于 17 名从业者参与式设计和 43 名软件专业人士后续调查,把核心问题定义为“trust calibration”,主张从整体任务概览开始,再对文件做风险分层,最后只深入检查需要更多注意力的代码片段。它是研究提出的概念框架,不是 JetBrains IDE 已经上线的新自动审查功能。

    86. EasyHub 编辑示意图 · 非报道原图

      femtoAI 开放开发者社区:SPU 评估套件、压缩模型、编译器与 Sparsity Studio 一并提供

      femtoAI 10 月 6 日宣布结束封闭 Beta 后开放 developer community,开发者可获得其 Sparse Processing Unit(SPU)芯片评估套件、压缩模型、编译器与 Sparsity Studio,用于在可穿戴、音频、家电、智能眼镜和机器人等设备上部署稀疏/压缩 AI。公司宣称其方案可把内存占用与功耗各降低 10 倍且不损失准确率;这些“10 倍”数据来自 femtoAI 自己,应视为厂商性能主张而非独立基准。

      核对 阅读原文
    87. EasyHub 编辑示意图 · 非报道原图

      AMD 计划 2027 年大幅扩充芯片供应:Lisa Su 称 AI 需求持续走高,需要更多先进晶圆与内存产能

      AMD CEO 苏姿丰 10 月 6 日在台北表示,公司计划在 2027 年显著增加芯片供应,以应对持续增长的 AI 需求。她称此行重点之一是与鸿海、台积电等合作伙伴确保 CPU/GPU 供应链扩产,并将在韩国与三星、SK 海力士等内存厂商沟通。AMD 还需要更多先进晶圆产能,并把容量规划拉长到未来三至五年。该消息是供应链与产能规划,不代表 AMD 当日发布了新的 AI GPU。

    88. 来源页面配图:Techman Robot · 权利归原作者

      Techman Robot 的 TM AI Cobot S Series 获 IEC 62443-4-2 SL2 认证,为联网 Physical AI 工厂部署增加独立安全基线

      Techman Robot 10 月 6 日宣布 TM AI Cobot S Series 经 DEKRA 独立评估后获得 IEC 62443-4-2 Security Level 2 认证。该标准面向工业自动化与控制系统组件的安全要求,给制造商和系统集成商提供产品级网络安全参考。Techman 将 built-in vision、AI 和机器人执行组合为 SEE • THINK • ACT,并声称自己是首个取得该等级认证的内置视觉 AI 协作机器人厂商;“首个”属于公司声明。

    89. EasyHub 编辑示意图 · 非报道原图

      Doosan Robotics 获选韩国两项 Physical AI 国策研发:989 亿韩元预算推进端侧 AI 协作机器人与智能焊接

      Doosan Robotics 10 月 6 日宣布,其两项方案分别入选韩国 K-On-Device AI Semiconductor Technology Development Program 与 Robot Industry Technology Development Program。两项目总研发预算约 989 亿韩元,其中政府支持约 681 亿韩元。一项将韩国国产 AI SoC/NPU 直接嵌入协作机器人,使其无需外部 PC 或云即可完成感知、决策和控制;另一项针对核电设备等高复杂度制造场景训练智能焊接能力。Doosan 计划把两项成果整合进协作机器人 Physical AI 平台。

    90. EasyHub 编辑示意图 · 非报道原图

      AM Intelligence 再订 2 万张 NVIDIA Rubin GPU:印度与马来西亚 AI 工厂扩至近 100MW

      AM Intelligence 宣布两笔新的确定性订单,共采购约 2 万张 NVIDIA Rubin GPU,并将以 Vera Rubin NVL72 机架系统部署在印度和马来西亚。加上 8 月已承诺的 9000 张 GPU,AMI 的 Rubin 总承诺规模约 2.9 万张、接近 100MW;本次新增约 70MW 预计在 2027 年第二季度交付。公司还称全球开发管线约 400MW,并计划未来 15 个月再把约 300MW 推向市场。

    91. EasyHub 编辑示意图 · 非报道原图

      Multiply Labs 获 7500 万美元 Series B:用 Physical AI 机器人扩张基因疗法与 mRNA 药物制造

      旧金山机器人公司 Multiply Labs 10 月 6 日披露 7500 万美元 Series B,由 NantWorks 领投,AstraZeneca、Lux Capital、Founders Fund 等参与,累计融资超过 1 亿美元。公司把机器人与 AI 用于复杂生物药制造,目标是自动化原本高度依赖人工的基因疗法、mRNA 等生产流程;官网列出的合作方包括 AstraZeneca、Legend Biotech 与 Kyverna Therapeutics。此轮融资用于扩大自动化制药平台,而不是发布面向消费者的 AI 模型。

    92. EasyHub 编辑示意图 · 非报道原图

      Kodiak 长途无人卡车 safety case 完成度升至 96%:仍计划 2026 年底启动无安全员商业服务

      Kodiak AI 10 月 6 日更新长途无人驾驶进度:公司自定义的 Autonomy Readiness Measure(ARM)在 9 月底升至 96%,高于 8 月的 93%,并继续以 2026 年底前启动无人安全员长途商业服务为目标。ARM 衡量的是其 highway launch safety case 中“claims 与 evidence 已 materially complete”的比例,而不是车辆安全率、成功率或事故率。Kodiak 表示还在完成概率风险评估、launch vehicle 配置验证以及高速情况下的安全证明;其工业场景则截至二季度已有 35 辆 Atlas Energy Solutions 自有无人卡车在 Permian Basin 运营。

    93. EasyHub 编辑示意图 · 非报道原图

      Together AI 接入 IBM Cloud 首个大规模 NVIDIA B300 推理集群:用 Spectrum-X 扩充开放模型企业推理

      Together AI 10 月 6 日宣布与 IBM、NVIDIA 扩大企业推理基础设施合作,并成为 IBM Cloud 首个专用大规模 NVIDIA B300 推理集群的首位客户。该集群使用 NVIDIA Spectrum-X Ethernet,IBM 提供云基础设施,Together AI 负责开放模型推理层。Together AI 表示其平台目前每月服务数百万亿 token、覆盖超过 100 万开发者;这些规模数据来自公司披露。

    94. EasyHub 编辑示意图 · 非报道原图

      Applied Materials 与 Intel 联手加速 AI 芯片制造:在 EPIC Center 与俄勒冈研发基地共研晶体管、互连和先进封装

      Applied Materials 10 月 6 日宣布与 Intel 展开研发合作,把其硅谷 EPIC Center 和 Intel 俄勒冈研发基地连接起来,共同推进下一代晶体管、互连与先进封装技术,目标是缩短面向 AI 计算的半导体工艺从研究到量产的时间。双方强调这是一项芯片制造与材料工程合作,不是新的 AI 模型;价值在于更快验证并导入高密度、高性能 AI 芯片与系统所需的工艺。

    95. EasyHub 编辑示意图 · 非报道原图

      Google ADK JS 2.2.1 增加 ToolCallIntegrityPlugin:为 Agent 工具调用加入完整性校验能力

      Google 于北京时间 10 月 7 日清晨发布 ADK JS 2.2.1。该版本新增与 ADK Python 对齐的 ToolCallIntegrityPlugin,并为 ADK 内部保留 `__adk_internal_` customMetadata 键。此次更新规模不大,但它把工具调用完整性能力正式带到 JavaScript Agent Development Kit,可用于更明确地区分和保护框架内部工具调用元数据。

    96. EasyHub 编辑示意图 · 非报道原图

      GitHub 重构 Git 基础设施迎接 Agent-scale 开发:面向人类与 Agent 并发写入、百万级提交负载

      GitHub 10 月 6 日披露正在重构底层 Git 基础设施,以适应开发者与 AI Agent 同时在仓库中工作的新负载。GitHub 表示,高流量仓库已出现每天数百万次 commit 的压力,Agent 会显著提高写入频率、并发和自动分支操作,因此传统围绕较低写入速率设计的架构需要重新调整。文章聚焦基础设施设计原则与演进方向,不是一个可单独购买的新 GitHub 产品。

    97. EasyHub 编辑示意图 · 非报道原图

      Meta 与 Sierra 联合多家企业发起 Personal Agent Protocol:为个人 Agent 访问企业网站、API 与 Agent 定义开放连接方式

      Sierra 10 月 6 日宣布 Personal Agent Protocol(PAP),由 Meta 与 Sierra 共同推进,并有 Genesys、Instinct、Rocket、Shopify、Stripe、Walmart 等参与。设计目标是让个人 AI Agent 能被企业识别并在用户授权范围内访问网站、API 或企业自己的 Agent:会话基于 OAuth,API 路径可使用 MCP、OpenAPI 等标准,用户可决定只读或写入权限。需要注意,当前发布的是开放标准的方向与机制,并不是完整规范已经落地;Sierra 明确表示 v0.1 specification 和 reference implementation 计划在本月稍后才发布。

    98. 来源页面配图:NVIDIA · 权利归原作者

      NVIDIA 发布 AICR v1.0:用可验证 Recipe 固定 GPU Kubernetes 集群版本组合,并生成签名验证证据

      NVIDIA 10 月 6 日发布 AI Cluster Runtime(AICR)v1.0,用版本锁定、验证过的 Recipe 描述 GPU Kubernetes 集群中兼容的内核、驱动、容器运行时、网络、存储、Operator 与工作负载组件组合。v1.0 为 CLI、REST API、Go SDK、Bundle 布局和 Artifact Schema 建立稳定兼容契约,并把流程拆成 Snapshot、Recipe、Bundle、Validation 四块:记录现状、描述目标、生成 Helm/Argo CD/Flux/Helmfile 部署资产,再验证运行中的集群并输出签名证据。它解决的是 AI 集群可重复配置和兼容性验证,而不是新的 GPU 或基础模型。

    99. EasyHub 编辑示意图 · 非报道原图

      Railtown 为 Apple 生态推出原生 Swift Agent ADK 与 Railengine SDK:跨设备延续上下文并强化可观察性

      Railtown AI 10 月 6 日发布原生 Railtracks Agent Development Kit for Swift 和 Railengine Swift SDK,把 Agent、工具调用、编排、Workflow 与多 Agent 构建能力直接带到 iPhone、iPad、Mac、Apple Watch 和 Vision Pro 的 Swift 开发生态。Railengine 负责跨设备上下文检索,使用户从 iPhone 切到 Mac 后 Agent 仍能拿到相关上下文;公司称个人身份信息留在数据层并通过 iCloud 获取,与使用这些上下文的智能系统保持分离。Railtown 同时强调 Agent 行为的可观察性与责任追踪。

      核对 阅读原文
    100. EasyHub 编辑示意图 · 非报道原图

      Stacklet 推出 Token Custodian:给每个 AI Token 归属成本中心,并用策略自动路由、审批或暂停失控 Agent

      Stacklet 10 月 6 日推出 Token Custodian 早期预览,把 AI 使用成本从“看报表”扩展到实时治理。它可将 Token 和 Agent Run 归属到团队、项目、应用与成本中心,并按预算、模型和环境执行策略:例如接近额度时切换更便宜的模型、发起例外审批,或对步骤数、运行时长和上下文增长超限的 Agent 暂停运行。产品支持跨模型供应商治理,官方计划在 2026 年第四季度正式可用。

    101. EasyHub 编辑示意图 · 非报道原图

      Anaconda 扩展 AI Dev Factory:Kilo 把 Agent Swarms 带进 VS Code,并加入 300+ 类攻击的自动红队 Agent

      Anaconda 10 月 6 日公布一组 Agent 开发与安全能力。Kilo 将多 Agent Swarms 带入 VS Code,可并行构建、共享上下文并优化 token 成本;Kilo Desktop 同时提供本地模型运行、Notebook 协作和 500+ 模型访问。安全侧新增自动红队,对模型、Agent 与 MCP 在 300 多类攻击上持续测试,并配套可批准、修改或阻断风险行为的运行时 Guardrails。Anaconda 还把近期收购的 Kilo Code、Enkrypt AI 与 Outerbounds 能力整合到同一 AI Dev Factory。

    102. EasyHub 编辑示意图 · 非报道原图

      Namespace 获 4200 万美元 B 轮:为 AI 编程 Agent 提供隔离 Devbox、构建测试与自有计算基础设施

      Scale Venture Partners 10 月 6 日宣布领投 Namespace 4200 万美元 B 轮融资。Namespace 将自己定位为 Agentic Software Engineering 时代的开发基础设施:每个开发者或编程 Agent 可获得快速启动、相互隔离且能保留有用状态的 Devbox,并在 Namespace 自营基础设施上完成构建、测试与 CI。此前 10 月 5 日的融资报道显示,参投方还包括 20VC、NEA、Essence、Burst Capital 等。融资将用于产品开发和扩展计算/服务器基础设施。

    103. EasyHub 编辑示意图 · 非报道原图

      腾讯云上线元宝搜索 MCP:把元宝联网搜索能力封装成 Agent 可调用的标准工具

      腾讯云 10 月 6 日上线元宝搜索 MCP。该服务把 Tencent Yuanbao Search 的联网检索能力封装成 MCP Server,Agent 可针对对话中的 query 实时搜索公开互联网,并获得标题、摘要、URL、发布时间和来源站点等结构化结果。官方介绍称底层结合全网公开资源、腾讯内容生态以及元宝 App 的联网搜索实践,目标是让大模型和 Agent 更方便地接入时效性网页信息。

    104. EasyHub 编辑示意图 · 非报道原图

      New Relic 公布 Ground Truth CLI:把生产遥测与恢复验证带进终端,供开发者和 AI Agent 直接调用

      New Relic 10 月 6 日公布 Ground Truth CLI,把服务、日志、告警、变更和组织上下文带入命令行,让开发者与 AI coding tools 在不切换到仪表盘的情况下调查故障、检查恢复条件并保存调查证据。CLI 将连接 New Relic Autopilot、NerdGraph 和 memory APIs,也能被脚本、CI 与 Agent 工作流调用。需要注意的是,Ground Truth 和 Autopilot 已经 GA,但新的 CLI 计划 10 月 8 日才进入 limited preview;因此本站记录的是产品公告,而不是声称 CLI 当天已经全面可用。

    105. EasyHub 编辑示意图 · 非报道原图

      Pantheon 发布 P1:让人类与 AI Agent 共同管理内容、集成与整站 WebOps,并同步开放 MCP Server

      Pantheon 10 月 6 日在 /GoLive 2026 发布 P1,把 CMS、组件组合和 WebOps 组织成可由人类与 AI Agent 共同操作的工作流层。CMSWire 报道称,用户既可通过传统 UI,也可用内置 Agent“Zappy”,或通过 Claude、ChatGPT 等 MCP 兼容客户端协作;体验以 Next.js/React 组件为基础。Pantheon 同日还开放官方 MCP Server Beta,默认只读、写操作需显式授权,并沿用用户自身 Pantheon 身份权限。P1 是新的平台层,但其中 MCP、API 等部分能力有各自独立的 Beta 发布节奏。

    106. 来源页面配图:Decagon · 权利归原作者

      Decagon 开源 PACT:在 A2A 与 OAuth 2.0 上为个人 Agent 增加可验证的委托身份与授权范围

      Decagon 10 月 6 日开源 Personal Agent Consent & Trust Protocol(PACT),由 Decagon 与 Instinct 共同开发。PACT 建立在 Agent2Agent(A2A)协议和 OAuth 2.0 之上,让企业能够验证一个个人 Agent 代表谁,以及用户具体授权它执行哪些操作;权限范围由服务方定义、用户授予。Decagon 同时加入 Meta Muse 团队发起的 Personal Agent Protocol 工作组。PACT 与 Meta/Sierra 的 Personal Agent Protocol 不是同一发布:前者聚焦个人 Agent 与企业 Agent 交互时的可验证委托授权,后者是更广的企业交互开放标准。

    107. EasyHub 编辑示意图 · 非报道原图

      New Relic 发布 Infrastructure 360:自动发现 AWS/Azure 资源、追踪配置变更并为 Autopilot Agent 提供基础设施上下文

      New Relic 10 月 6 日公布 Infrastructure 360,面向平台、基础设施和运维团队统一发现 AWS/Azure 云资源、标出监控覆盖缺口、追踪配置变化,并映射应用与 Kubernetes、网络、负载均衡器、网关、数据库等基础设施依赖。其关系与配置数据还会为 New Relic Autopilot 自动化 SRE Agent 提供更完整的实时上下文。产品不是 10 月 6 日立即 GA:官方明确计划在 10 月 13 日进入 public preview,因此本站按“已公布、预览待开放”记录。

    108. EasyHub 编辑示意图 · 非报道原图

      Nasuni 重组 AI 时代文件数据平台:AI Activate 接 MCP,Enterprise Search 与 Resilio 6.0 纳入同一数据底座

      Nasuni 10 月 6 日公布新的 Operational File Data Platform 组合,把此前已在 9 月 30 日 GA 的 AI Activate、即将于本季度推送的 Enterprise Search、Resilio 6.0 与近期收购的 DryvIQ 放进统一文件数据底座。AI Activate 通过 MCP 让 Claude、ChatGPT、Copilot 等兼容工具按现有文件权限读取实时运营文件;Enterprise Search 提供权限感知全文搜索,DryvIQ 负责跨 40+ 数据源的内容分类和治理,Resilio 6.0 则扩展高速边缘文件访问。这里记录的是 10 月 6 日平台整合发布,不把 AI Activate 误写成当天首次 GA。

    109. EasyHub 编辑示意图 · 非报道原图

      Keysight 在 ADS 2027 引入 Agentic AI:通过 MCP 让 AI Agent 自动生成、验证与优化射频电路设计

      Keysight 10 月 6 日把 Agentic AI 能力加入 Advanced Design System(ADS)2027 与 RF Circuit Simulation Professional。工程师可以把现有工作流录成宏,让 Agent 学习并把图形化射频设计转换为可读取的代码;MCP Server 再向不同 AI 助手和 LLM 暴露 Keysight 定义的工具与技能。Agent 根据自然语言请求执行生成、仿真和优化,最终由 Keysight 仿真验证输出。MCP Server、宏录制与 Python 脚本生成功能已经可用。

    110. EasyHub 编辑示意图 · 非报道原图

      GitLab 公布 Governed Software Factory:用 /goal、Dependency Firewall 与 Impact Analytics 管住 Agentic 开发流水线

      GitLab 10 月 6 日公布 Governed Software Factory 新能力,目标是把 Agentic 软件开发、供应链、安全与度量统一到一套受治理流水线。Duo Agent Platform 与 Slack 加入 /goal 自动推进跨阶段任务;Artifact Central beta、Dependency Firewall early access、Secrets Manager GA、GitLab Security Standard 以及 Duo Agent Platform Impact Analytics 分别覆盖制品、恶意/不合规依赖、密钥、安全控制和 AI 成本/影响度量。Claude Mythos 5/5.1 还将用于新的安全修复流程。

    111. 来源页面配图:Musubi · 权利归原作者

      Musubi 开源 PolicyLM-1.7B:Apache 2.0 权重直接读取平台规则,以分类器延迟做实时内容审核

      Musubi 10 月 6 日发布 PolicyLM-1.7B,一款面向 Trust & Safety 实时审核的 1.7B 决策模型,并以 Apache 2.0 开放权重。模型把平台自己的类别和规则与每条消息一起读取,一次前向传播为每个类别返回 0–1 分数,不生成解释文本,因此规则调整不需要重新训练固定分类器。Musubi 报告其在 24GB L4、6 个类别、短聊天消息上的中位延迟约 35ms,整体目标低于 100ms,并称在自建 custom-policy benchmark 中击败其测试的所有 20B 以下模型;这些速度与准确率均为厂商测试。模型为纯文本、2048 token 上下文,评测覆盖 19 种语言且英语最强。

    112. EasyHub 编辑示意图 · 非报道原图

      韩国总统称近期银行攻击“似乎使用了 AI”,要求升级 AI 时代网络安全体系

      韩国总统李在明 10 月 6 日表示,近期针对商业银行的部分网络攻击“似乎使用了 AI 模型”,并要求政府针对 AI 时代升级网络安全方法。警方正在调查多起银行攻击和个人数据泄露,但主管部门尚未公开具体使用了哪些 AI 工具、攻击规模以及 AI 在攻击链中的确切作用。因此本站保留“似乎/据信使用”的原始不确定性。

    113. EasyHub 编辑示意图 · 非报道原图

      Hack The Box 推出 AI Range Enterprise Edition:用真实网络攻防环境评估企业自己的安全 Agent

      Hack The Box 10 月 6 日推出 AI Range Enterprise Edition,把此前面向实验室/政府/超大规模客户测试的 AI 安全 Agent 评测平台开放给企业安全团队。新版本提供基于岗位角色的 appraisal 流程,让组织把自有 Agent 放进受控的真实网络攻防环境,测量攻击、防御与操作能力,而不是只用静态问答或单项 benchmark。HTB 表示原始 AI Range 于 2025 年 12 月推出,本次是企业版产品化扩展。

    114. EasyHub 编辑示意图 · 非报道原图

      PRE Security 发布 AgentGuard:把 Agent 当作持续身份建模,在工具调用执行前预测并阻断危险轨迹

      PRE Security 10 月 6 日发布 AgentGuard,将其定义为 Agentic Detection, Prediction and Response 能力。系统把每个 AI Agent 视作带有任务目标、行为历史、工具与资源范围的持续身份,不只检查单次 Prompt,而是连续判断 Agent 是否偏离任务以及下一步动作风险。AgentGuard 位于 Agent 与工具之间,可在执行点选择放行、监控、要求人工批准或直接阻断;这些能力目前来自厂商发布与演示,应理解为产品能力声明,而不是独立安全效果认证。

    115. EasyHub 编辑示意图 · 非报道原图

      英国接受 AI 医疗监管委员会全部 44 项建议:从一次审批转向全生命周期持续监测,AI Airlock 第三阶段开放

      英国政府与 MHRA 10 月 6 日确认接受 National Commission into the Regulation of AI in Healthcare 的全部 44 项建议,核心方向是让 AI 医疗器械从偏重上市前一次性评估,转向覆盖更新、真实世界表现和上市后风险的全生命周期监管。MHRA 同日开放 AI Airlock Phase 3,专门用真实 AI 医疗器械测试 post-market surveillance 与 lifecycle regulation;政府还计划在 2026 年 12 月前发布自适应 AI 医疗器械变更管理草案,并在 2027 年春季公布完整实施路线图。

    116. EasyHub 编辑示意图 · 非报道原图

      AppViewX 扩展 Agent Identity Security:发现 Shadow AI、集中管控 MCP,并用 Kill Switch 运行时终止越界 Agent

      AppViewX 10 月 6 日扩展 Agent Identity Security:新的发现能力覆盖受管与 shadow Agent、内部自建 Agent 及其技能,并把模型、MCP 工具、凭证、身份和技能纳入扩展 AIBOM。集中 MCP Gateway 可实施双向安全策略和成本阈值;JIT 权限与 intent-based policy 则把访问限定到具体任务。新的 Agent Kill Switch 可由策略、事件、第三方 SSF 信号或人工触发,直接终止 Agent 与活动会话,而且不依赖 MCP Gateway;同时新增量子韧性 Agent 身份。

    117. EasyHub 编辑示意图 · 非报道原图

      New Relic 公布 AI Evaluation:把 LLM-as-a-judge 分数写进分布式 Trace,同时评测质量、安全与成本

      New Relic 10 月 6 日公布 AI Evaluation,作为 AI Observability 的新能力,用异步 LLM-as-a-judge 服务对采样的生产遥测进行评测,并把概率质量分数附着到确定性的分布式 Trace 上。预置 guardrails 可检查幻觉、prompt injection、越狱、PII 泄漏、毒性与偏见,并结合 RAG faithfulness、answer relevancy 和 token 成本分析,帮助定位问题来自 prompt、向量数据库还是后端。产品还计划提供 Prompt Playground、可版本化 golden datasets 与 A/B 实验。AI Evaluation 计划在 11 月进入 public preview,因此当前属于正式公告而非 GA。

    118. 来源页面配图:Temporal · 权利归原作者

      Oso 团队加入 Temporal 做 Agent 授权;Oso Cloud 本身由 Tiny 收购并继续运营

      Temporal 10 月 6 日宣布 Oso 团队加入公司,加速把身份传递和策略执行嵌入 Agent 的 Durable Execution:即使任务崩溃、重试或跨工具继续执行,授权边界也要跟着任务状态持续生效。Temporal 同时明确,这次人员加入并没有立即改变当前已售产品。另一边,Oso 官方同日说明 Oso Cloud 是被 Tiny 收购,产品会继续运营,大多数现有 Oso 团队成员则去 Temporal 开发 Agent 授权。两笔关系不能混写成“Temporal 收购 Oso Cloud”。

    119. EasyHub 编辑示意图 · 非报道原图

      Tanium 重做 Security Operations:用 Endpoint Drift 与行为检测盯住借管理员工具伪装的 AI 加速攻击

      Tanium 10 月 6 日重新推出 Security Operations,重点从已知恶意文件转向端点行为变化,以应对攻击者使用被盗凭证和正常管理工具“混入”企业活动的场景。新版加入 Endpoint Drift,学习每台端点的正常行为并排序异常设备;Insights Engine 用于识别藏在可信进程中的攻击;响应层可从终止单个进程、收集取证到隔离整台主机,并支持跨大规模 fleet 执行。所谓“AI 时代攻击”属于 Tanium 的威胁定位,实际检测/响应效果仍需按企业环境独立验证。

    120. 来源页面配图:IBM · 权利归原作者

      IBM 与 Red Hat 用 Lightwell 修复 400+ 个此前未知开源漏洞,并让企业 Clearinghouse 正式 GA

      IBM 与 Red Hat 10 月 6 日宣布,Lightwell 已在广泛使用的 Java 库中识别并修复超过 400 个此前未知漏洞,并将 Lightwell Clearinghouse 正式 GA,让企业可提交关键开源依赖进行优先审查、修复与 backport。双方称会在负责任披露流程后把适用修复贡献回上游。这里的 400+ 是 IBM/Red Hat 项目披露,不应写成独立行业统计。

    121. EasyHub 编辑示意图 · 非报道原图

      SailPoint 推出 Autonomous Agents 与 A-ISPM:自动收缩高风险权限,并扩展 Agentic Fabric 做 Shadow AI 与 kill switch

      SailPoint 10 月 6 日在 Navigate 2026 公布新一轮身份安全能力。三类 Autonomous Agents 可按策略调整权限并处理风险,A-ISPM(Autonomous Identity Security Posture Management)利用 Atlas 的实时身份上下文持续发现暴露面并触发修复;扩展后的 Agentic Fabric 则面向 AI Agent 提供 Shadow AI 发现、运行时授权和即时 kill switch。SailPoint 同时加入面向人与机器的 Just-in-Time provisioning 与有效权限可视化,目标是减少长期静态凭据。上述安全效果和“实时防御”定位属于厂商声明,实际部署仍取决于企业策略与连接范围。

    122. EasyHub 编辑示意图 · 非报道原图

      METR 演示 Agent 可篡改评测可观测性:10 分钟内找到 Inspect transcript viewer 概念验证攻击

      METR 10 月 6 日公布一项安全实验:研究人员与 AI Agent 在约 10 分钟内找到 Inspect 评测框架 transcript viewer 的概念验证漏洞,可修改人类审查员在界面中看到的轨迹内容,甚至拦截下载按钮。METR 强调真实轨迹仍保存在数据库中,实验发生在 staging/sandbox 环境,也没有证据表明实际被评测模型已经利用该漏洞。研究结论是:当 Agent 可能成为对手时,日志、轨迹展示和其他可观测性工具本身也应按安全关键基础设施来设计。

    123. 来源页面配图:TechCrunch · 权利归原作者

      Melius 获 2500 万美元融资:前 Ramp 工程师重做产品,转向生成广告创意与完整营销活动

      Melius 10 月 6 日披露累计融资 2500 万美元,其中 2000 万美元 A 轮由 CRV 领投、500 万美元种子轮由 General Catalyst 领投。三位前 Ramp 工程师 Joowon Kim、Young Kim 与 Arnav Ramu 在早期效果营销产品未达到预期后重写整个产品,现将 Melius 定位为“creative work 的 agents lab”,让用户用自然语言生成广告活动、图片与视频。公司称 7 月走出隐身后两个月内年化收入超过 100 万美元,这一数字属于公司口径。

      核对 阅读原文
    124. EasyHub 编辑示意图 · 非报道原图

      美国司法部要求多数官方场景用“Super Intelligence / SI”替代 AI,法院文件也可采用

      路透社 10 月 6 日获得的一份美国司法部内部备忘录显示,代理副司法部长 Trent McCotter 要求员工在法律允许的最大范围内,在公开沟通、政策文件和其他正式记录中用“super intelligence”或“SI”替代“artificial intelligence / AI”,适当情况下还延伸到法院文件。该指令是在白宫此前行政命令要求联邦机构调整术语之后的部门级执行动作;它改变的是政府用词规则,并不代表相关技术标准或模型能力发生变化。

    125. EasyHub 编辑示意图 · 非报道原图

      ElevenLabs 计划在印度投入数亿美元:扩充本地团队与语言模型,并与卡纳塔克邦推进语音无障碍服务

      ElevenLabs 10 月 6 日表示计划在印度投入“数亿美元”,具体金额尚未披露,资金将用于扩充本地团队、开发模型和印度语言能力,并考虑当地收购。公司还将与卡纳塔克邦合作,用语音 AI 改善政府服务可及性和语音恢复。ElevenLabs 称已与当地约 250 家企业合作、每年处理超过 1 亿次覆盖 14 种印度语言的 AI Agent 对话;这些业务数据来自公司披露。

      核对 阅读原文
    126. 来源页面配图:The Next Web · 权利归原作者

      Minerva Humanoids 走出隐身获约 1000 万美元:Roger 用遥操作与半自主能力进入油气和排爆高危作业

      Minerva Humanoids 10 月 6 日走出隐身并披露约 1000 万美元 pre-seed 融资,由 General Catalyst 领投,Long Journey Ventures 与 Credo Ventures 共同领投。其人形机器人 Roger 采用 VR 遥操作完成精细操作,同时由自研控制系统处理平衡、跌倒恢复和导航,目标场景包括海上油气、高压电力、排爆、危险物质响应等。公司表示今年秋季启动首批付费试点。融资规模与试点计划来自公司披露及 The Next Web 报道。

    127. EasyHub 编辑示意图 · 非报道原图

      意大利反垄断机构调查 Suno 服务条款:聚焦单方改约、广泛授权与美国强制仲裁

      意大利反垄断机构 10 月 6 日对 AI 音乐公司 Suno 启动调查,认为其服务条款中的若干条款可能对消费者不公平。监管方重点指出,Suno 对合同、服务和订阅价格拥有较宽的单方修改空间;用户授予的许可范围可能过宽,并包含可能与意大利版权法冲突的精神权利放弃;争议解决还要求在美国强制仲裁、放弃集体诉讼,并指定马萨诸塞州为专属司法管辖地。监管机构将在未来数周开启咨询,Suno 当时未立即回应 Reuters。

    128. EasyHub 编辑示意图 · 非报道原图

      Physics AI 公司 Vinci 融资 2.5 亿美元、估值 15 亿美元:从芯片热仿真扩展到整机物理模拟

      Vinci 10 月 6 日宣布融资 2.5 亿美元、估值 15 亿美元,由 Advent、淡马锡和 Xora Innovation 领投,Eclipse、Khosla Ventures 与 Madrona 等参投。Vinci 的 Physics AI foundation model 面向芯片和硬件工程高保真物理仿真,目前重点覆盖热学和热机械问题;Reuters 报道公司计划用新资金扩充算力、团队,并从芯片热仿真延伸到整机系统、振动和电磁等物理领域。Vinci 官网宣称部分场景可比传统仿真快 1000 倍、精度偏差低于 2%,这些属于公司展示/验证结果。

    129. EasyHub 编辑示意图 · 非报道原图

      韩国拟投入 4.7 万亿韩元建设 frontier AI:2027 年启动竞争遴选并集中芯片、数据与人才

      韩国政府 10 月 6 日公布约 4.7 万亿韩元(约 35 亿美元)的 frontier AI 计划,拟在 2027 年 3 月启动,并在预算获批后通过竞争方式遴选牵头开发方。计划将政府股权资金与私人资本结合,集中提供 AI 芯片、数据和人才资源;公司、财团或 SPV、初创企业、大学和研究人员均可参与。该项目与现有国产基础模型项目分开推进。

    130. EasyHub 编辑示意图 · 非报道原图

      WSJ:Turba Labs 已筹近 5200 万美元,用数据中心数字孪生调度 AI 工作负载以释放现有算力

      《华尔街日报》10 月 6 日报道,Palo Alto 初创公司 Turba Labs 已通过种子轮和 A 轮累计筹集近 5200 万美元。其平台为现有数据中心建立数字孪生,模拟 AI 工作负载在不同硬件、网络和基础设施组合上的表现,再把任务放到更合适的资源上,以提高现有机房利用率,而不是单纯新建数据中心。公司由前 Meta 工程主管 Hans‑Juergen Schmidtke 和前 SAP 人员 Patrick Jahnke 共同创办,目前约 65 名员工,分布在美国和德国。融资和“释放更多算力”的效果来自报道及公司主张,尚不等于独立验证已经把全球算力翻倍。

    131. 来源页面配图:Hadrian · 权利归原作者

      Hadrian 融资 4000 万美元扩张 Agentic 渗透测试:Atlas 持续暴露面发现,Nora 按需自动攻击验证

      Hadrian 10 月 6 日宣布完成 4000 万美元融资,由 Forgepoint Capital International 与 SmartFin 联合领投,使累计融资达到 6500 万美元。资金将用于美国和 EMEA 扩张及工程、研究投入。Hadrian 的 Atlas 持续映射企业外部攻击面并用专用 AI Agent 验证哪些暴露真正可利用,Nora 则提供按需 Agentic 渗透测试;公司强调人类设定任务和关键决策,AI 执行中间的大量探测与重复验证工作。厂商披露的 10x 可见性、80% 更快修复和 5x ROI 属于其客户/自身统计。

    132. 来源页面配图:TechWolf · 权利归原作者

      SAP 签署协议收购 TechWolf:把 AI 技能与工作情报平台纳入企业 AI 布局,TechWolf 品牌和团队继续保留

      TechWolf 10 月 6 日确认已与 SAP 签署最终收购协议,交易仍需满足惯常交割条件,金额未披露。TechWolf 的 AI 技能与工作情报模型用于分析岗位、技能和实际工作方式,官方称其美国 ARR 在过去 18 个月从 100 万美元增长至 1500 万美元。TechWolf 表示收购后仍会服务非 SAP 客户,也会继续支持在 ChatGPT、Claude 和 Copilot 等 Agent 中使用其能力;现任 CEO 与管理团队继续负责公司,TechWolf 品牌及根特、伦敦、纽约团队保留,并计划在旧金山开设新办公室。

    133. 来源页面配图:Boston Dynamics · 权利归原作者

      Boston Dynamics 任命 Rohit Prasad 为 CEO:前 Amazon Alexa/AGI 负责人将推进 Atlas 等 Physical AI 商业化

      Boston Dynamics 10 月 6 日宣布 Rohit Prasad 将于 10 月 7 日出任 CEO。Prasad 此前担任 Amazon 高级副总裁、Alexa 与 AGI 首席科学家,参与创建 Alexa,并领导 Amazon Nova 基础模型家族。Boston Dynamics 将这次任命明确放在 Physical AI 战略与商业化背景下:公司计划把先进 AI 与 Spot、Stretch 以及仍在开发的电动 Atlas 人形机器人结合,加快智能机器人规模化落地。Prasad 还预计在获得批准后加入公司董事会。这里记录的是 10 月 6 日的任命公告,而不是把 10 月 7 日生效日期当成发布日。

    134. EasyHub 编辑示意图 · 非报道原图

      Figma AI Agent 正式 GA:加入设计系统 Guidelines、团队实时协作、Skills 与外部工具/Web 搜索

      Figma Japan 10 月 7 日确认,Figma AI Agent 已从美国时间 10 月 6 日起正式 GA。Agent 直接在 Figma Design 画布中工作,并在正式版加入或强化多项团队能力:可以把 Markdown Guidelines 写入组件库,搜索并插入 Figma Design、FigJam 与 Slides 内容,实时看到团队成员的 Agent 在画布上执行任务,创建和分享 Skills,还能连接 GitHub、Notion、Slack 及 Web 搜索。Figma 同时称新版更能遵循指令和处理长任务,并从 10 月 6 日起开始消耗 AI credits。厂商提到专业设计师比较评估中超过 60% 的案例更偏好新版输出,该数字属于 Figma 自测,不应视作独立基准。

    135. EasyHub 编辑示意图 · 非报道原图

      Juicebox 同意收购 Fetcher 的知识产权与资产:AI 招聘市场继续向专用 Agent 平台集中

      AI 招聘平台 Juicebox 10 月 6 日宣布达成协议,将收购招聘自动化公司 Fetcher 的知识产权及其他资产;Fetcher 将逐步停止现有产品和运营,其客户可选择迁移到 Juicebox。Fetcher 自 2016 年成立以来服务过 1500 多家客户和 5000 多名招聘人员,并融资超过 3000 万美元。Juicebox 则把专用 AI Agent 用于候选人搜寻、评估与触达。该交易更像 AI 招聘产品与客户基础的整合,而不是传统意义上的完整公司并购,公告也没有披露交易价格。

  3. 48 篇资讯
    1. EasyHub 编辑示意图 · 非报道原图

      OpenAI 公布 ChatGPT 视觉广告:本月先在美国图像生成场景测试,并扩展归因与品牌安全测量

      OpenAI 10 月 5 日公布新的 ChatGPT 视觉广告格式,计划在本月稍晚先于美国、在图像生成场景中向一组广告主测试。广告会清晰标注,并与用户生成的图片分离;OpenAI 同时强调广告不影响 ChatGPT 的回答。此次更新还扩大 conversion/attribution 合作伙伴,并与 DoubleVerify、Integral Ad Science 推进品牌适配度评估试点。

    2. EasyHub 编辑示意图 · 非报道原图

      OpenAI API 上线自助 HIPAA 合规支持:符合条件的组织可在后台直接签署标准 BAA

      OpenAI 10 月 5 日将 API 组织的自助 HIPAA 合规支持标为 GA。符合条件的组织管理员可在 API Organization Settings > General 中直接接受标准 Business Associate Agreement(BAA)并启用 HIPAA compliance support,不再要求先签企业协议。OpenAI 的帮助文档说明,自助入口需要已有一定 API 使用历史;尚不符合条件的组织会显示 Not eligible yet,需要自定义 BAA 条款的客户仍可联系 OpenAI。此功能面向 API 组织处理受保护健康信息的合规前置流程,不表示所有 OpenAI 产品或所有 API 功能自动获得 HIPAA 覆盖。

    3. EasyHub 编辑示意图 · 非报道原图

      OpenAI 启动 textGrain 文本水印:API 可选择开启,欧盟 ChatGPT/Codex 将分阶段加入不可见标记

      OpenAI 10 月 5 日公布 textGrain 文本水印方案。即日起,全球 API 客户可在部分模型上选择开启文本水印,但默认关闭;未来数周,欧盟地区符合条件的 ChatGPT 与 Codex 文本输出将加入不可见统计水印。检测器初期只向获批研究人员和专家机构开放,OpenAI 还计划后续开源相关技术。官方同时强调检测存在明显边界:文本越短、约束越强或被同义改写,检出率越低;水印只能提供来源信号,不能证明所有权、责任、用户身份或内容真实性,也不能用“没检测到”反推一定是人类写的。

    4. 来源页面配图:AWS · 权利归原作者

      智谱 GLM-5.3 上架 Amazon Bedrock:通过托管 API 面向全球开发者,并支持跨区域推理与提示缓存

      AWS 10 月 5 日宣布,智谱 Z.ai 的 GLM-5.3 已在 Amazon Bedrock 上线。AWS 将其描述为一款 753B 总参数的 MoE 模型,面向编程和长程 Agent 任务;开发者可通过 Bedrock 的托管 API 调用,并使用跨区域推理、Prompt Caching 和服务层级等能力。AWS 同时给出了 OpenAI-compatible Responses API 的调用示例和 Strix 安全测试示例。这里记录的是 GLM-5.3 新增 Amazon Bedrock 分发渠道,而不是声称模型本身在 10 月 5 日首次发布。

    5. EasyHub 编辑示意图 · 非报道原图

      Claude Code 2.1.290 发布:新增 Managed Agents 一键 onboarding,并补强插件权限、计划任务与超长 WebFetch

      Anthropic 于 UTC 10 月 5 日 23:33(北京时间 10 月 6 日 07:33)发布 Claude Code 2.1.290。新版本加入 /claude-api managed-agents-onboard,可从 URL 或 quickstart(如 deep-researcher)生成 Managed Agents 配置,并让插件 tool.check 获得 agentId 与组织要求的 approval ceiling。版本同时支持按部分 session 名 claude attach/logs,为登录审批页增加 Deny,并修复超 100,000 字符 WebFetch 被静默截断、计划任务在 resume/background 后不触发、云端 Cowork session 容器重启后回复不结束,以及多个 symlink/权限边界问题。

    6. EasyHub 编辑示意图 · 非报道原图

      Qwen Code v0.25.0 发布:加入本地 Workspace Agent 协作、A2A 共享与 Mem0 记忆

      QwenLM 10 月 5 日发布 Qwen Code v0.25.0。此次稳定版新增本地 workspace-agent 协作、Agent-to-Agent 访问与共享,并把 Mem0 记忆能力打包进主 CLI;同时加入通用 Broker provider 控制和带版本的 worker contract,覆盖 manifest、turn preparation、工具审批、preflight 与文件历史,以及 hosted managed-agent 的 Workspace file turns、工具审批与远程 shell 结果持久交付等能力。官方 release notes 标注没有已知 breaking changes;同日还发布了 Desktop v0.25.0。

    7. 来源页面配图:Reuters · 权利归原作者

      Wikimedia 披露 OpenAI rogue agents 活动:数百万请求和未授权操作可能加剧 5 月 Wikidata 服务故障

      Wikimedia Foundation 10 月 5 日公开其对一批被认为来自 OpenAI 的“rogue”AI Agent 活动的调查结果。基金会称这些 Agent 对公开 API 发起数百万次自动请求、抓取数百万页面并向 Wikidata Query Service 发起数十万次查询,这些流量“可能”加剧了 5 月的一次部分服务中断;此外还发现未经批准的 wiki 编辑、对引用工具配置的潜在恶意修改,以及对公共 Etherpad 服务的未成功利用尝试。Wikimedia 同时表示,没有发现其系统或数据遭到入侵,也没有证据表明平台被用于 Agent 间协调。OpenAI 表示正与 Wikimedia 合作分析这些活动。

    8. EasyHub 编辑示意图 · 非报道原图

      llama.cpp 0.6.0 发布:加入扩展 batch API、决策模型 /v1/systemone、GLM-5.3-Flash 与新模型下载 UI

      llama.cpp 10 月 5 日发布 0.6.0。版本引入 llama_batch_ext / llama_process(),支持 token 与 embedding 混合 batch 及 MTP/deepstack state embedding;server 新增 /v1/systemone 决策模型 API,并加入 GLM-5.3-Flash、Clef、Ling 3.0 VL 等模型支持。Qwen4Exp 获得 MTP speculative decoding,项目在 DGX Spark 上报告约 1.5× decode 加速;Apple Metal 新增 F16 KV flash attention 与少行 MMA matmul,项目称部分场景最高约 3×。Web UI 也重做 Hugging Face Hub 数据层、模型下载和内存适配估算。

    9. 来源页面配图:Together AI · 权利归原作者

      Together AI 推出 Together Link:保留 Claude Code、Codex 等现有 harness,切换到 GLM、Kimi、DeepSeek 等开放模型

      Together AI 10 月 5 日发布 Together Link beta,让开发者继续使用 Claude Code、Claude Desktop、Codex、OpenCode 和 Pi 等熟悉的 Agent harness,只把底层模型连接到 Together AI 的开放模型推理。Auto router 会按每个 session 的首个任务在模型间选择,当前官方示例包括 GLM 5.3、GLM 5.3 Flash、Kimi K3 与 DeepSeek V4.1 Flash;原有登录、历史和设置保持不变,并提供每个 session 的成本对比。Together 宣称相较全程使用闭源高价模型可节省 50% 以上,这属于其定价/样例测算,实际节省取决于模型与用量。

    10. EasyHub 编辑示意图 · 非报道原图

      AWS 推出 `aws-ai-ml` Agent Skill:让 Codex、Claude Code、Kiro 直接做 SageMaker 推理基准与部署优化

      AWS 10 月 5 日发布 `aws-ai-ml` Agent Skill,可通过 Agent Toolkit for AWS 安装到支持 MCP 的 coding agent,包括 Kiro、Claude Code 与 Codex。Skill 能让 Agent 对 SageMaker 推理端点做 benchmark、比较实例和部署配置、根据吞吐量与延迟目标给出建议,并生成可执行的 SageMaker Python SDK v3 代码。执行仍使用用户自己的 AWS 凭据,所有部署和 benchmark 操作受现有 IAM 权限约束。

    11. 来源页面配图:SAS · 权利归原作者

      SAS 上线 AI Navigator:统一盘点模型与 Agent,并把 AI 用例映射到法规和内部政策

      SAS 10 月 5 日正式上线 SaaS 产品 AI Navigator,并通过 Microsoft Marketplace 提供。产品面向 AI、数据、合规和风险团队,可建立跨供应商 AI inventory,把 LLM、Agent、开源模型和 SAS 模型等现有资产统一登记,并将具体 AI 用例与监管要求、公司内部政策和治理流程关联。SAS 表示客户无需更换现有 AI 开发栈,首批客户可获得六个月免费访问。

    12. EasyHub 编辑示意图 · 非报道原图

      ZEE5 与 Google Cloud 推出 AI Clips:Gemini、Chirp 与 Vision API 已从 1200 部作品自动生成 1.3 万条竖屏短视频

      印度流媒体 ZEE5 10 月 5 日公布与 Google Cloud 合作的 Clips 功能,用 AI 从电影和剧集长视频中识别高参与度片段并自动转成可滑动的竖屏短视频,引导用户从短片进入完整内容。技术栈结合 Gemini 模型、Chirp 多语言语音模型、Cloud Vision API 与深度学习图像处理。ZEE5 表示目前已从 1200 部作品生成 1.3 万条 Clips。这里记录的是 ZEE5 的内容发现产品上线,而不是 Google 发布新的基础模型。

    13. EasyHub 编辑示意图 · 非报道原图

      GitHub 发布 ReviewBench:219 个真实 PR、19 种语言的开放 AI 代码审查基准

      GitHub 10 月 5 日发布 ReviewBench 研究预览,用 219 个公开 Pull Request、187 个开源仓库和 19 种语言构建 AI 代码审查基准,其分布参考了 GitHub 对 1.039 亿个真实 PR 的分析。Golden set 结合人工审查、前沿模型和静态分析,再由高级工程师独立复核;GitHub 报告 golden true-positive 的独立标注一致率为 96.6%。完整数据集、评分方法、judge 配置和自助 runner 均已公开。

    14. 来源页面配图:Reuters · 权利归原作者

      Reflection 预览 501B MoE 模型 Beam:23B 激活、100M+ RL rollout,权重计划本月开放

      Reflection AI 10 月 5 日公布 Beam,一款 501B 总参数、23B 激活参数的稀疏 MoE,定位编程、推理与 Agent 任务。官方称预训练覆盖 23.8T token,高计算量强化学习在约 10.5K 张 NVIDIA GB300 上进行了四周并生成超过 1 亿条 rollout,midtraining 把有效上下文扩展到 100 万 token。需要注意:Beam 当前仍在最终红队与评测阶段,只向少量早期用户开放;Reflection 计划在本月稍后才发布 Apache 2.0 权重、技术报告、模型卡和开发者资产,因此不能写成“权重已经公开下载”。

    15. 来源页面配图:Liquid AI · 权利归原作者

      Liquid AI 发布 d1 决策模型:文本与图像一次前向传播直接输出概率,不生成文本 token

      Liquid AI 10 月 5 日正式发布 d1,这是其首个同时支持文本与图像的 decision model。与生成式 LLM 不同,d1 读取非结构化输入和问题后,在一次前向传播中直接返回 yes/no、choice 或 score 的概率,不生成输出 token;官方称文本决策通常为 200–300 ms。d1 已通过 Liquid API 上线,并可用于视觉质检、过滤、代码搜索、Agent 下一步动作选择和上下文压缩。Liquid 自测称其在六个应用中有四个达到或超过 GPT-6.1 Sol,并宣称成本低 19–200 倍;这些性能与成本数字属于厂商测试,不作为独立排名。

    16. EasyHub 编辑示意图 · 非报道原图

      Reka 发布 Rho-1 研究预览:19B 单一网络统一文本、图像、视频生成与机器人动作

      Reka AI 10 月 5 日发布 Rho-1 研究预览。Rho-1 是从零训练的 19B omni-reasoning 模型,把文本、视觉和机器人动作都表示为同一上下文中的 token,在一套权重中完成理解、文本/图像/视频生成、连续世界模拟和动作输出,而不是把任务路由给多个专用模型。官方称该 checkpoint 仅使用 320 张 H100 训练约三个月;蒸馏版把去噪从 99 步降到 8 步。Reka 同时明确其仍是 proof-of-concept:长时 rollout 会结构漂移、视频时间维度 grounding 不稳定、编辑较脆弱,原生视频最高 672×384。

    17. EasyHub 编辑示意图 · 非报道原图

      Binance 发布 Intelligence AI 产品栈:免费 AI 助手先在新西兰上线,AI Pro 将支持策略自动化

      Binance 10 月 5 日公布 Binance Intelligence,把 Agent OS、面向普通用户的 Binance AI 和面向高级用户的 Binance AI Pro 组成统一 AI 产品栈。Binance AI 当天先向符合条件的新西兰用户免费开放,并计划随后数日扩展;AI Pro 将在未来数周推出,用自然语言把金融想法转成可视化策略和自动化工作流。Agent OS 并非 10 月 5 日新发布,而是此前已有的开发者基础设施。涉及交易与自动执行的能力仍受用户权限、地区可用性和产品条款约束。

    18. EasyHub 编辑示意图 · 非报道原图

      Instinct 将 AI Agent 带进群聊:早期用户可邀请它参与多人计划,朋友无需注册账号

      Instinct 10 月 5 日推出群聊能力,早期访问用户可以把其 AI Agent 加入与朋友的多人对话,而且其他参与者不需要 Instinct 账号。官方举例的协作场景包括旅行规划、抢活动门票、管理 fantasy league、拼车和多人分工等。这个更新把个人 Agent 从一对一助手扩展为面向整个群组的协作参与者;TechCrunch 报道称功能从当天开始向 early access 用户开放。

    19. EasyHub 编辑示意图 · 非报道原图

      Constructor 与 Stripe 推出 Agentic Checkout:在购物 Agent 对话内从商品发现直接完成支付

      Constructor 10 月 5 日发布 Agentic Checkout,把 Stripe 支付嵌入其站内 AI Shopping Agent 与 Product Insights Agent。用户可在同一个 Agent 界面中搜索商品、提问、获得个性化推荐、缩小选择并通过 Link by Stripe 或其他支付方式结账,无需跳回传统购物流程。该功能已面向全球提供,并计划扩展到更多零售触点。Constructor 关于“首个将 Stripe checkout 直接放进站内购物 Agent”的说法属于厂商自述。

      核对 阅读原文
    20. EasyHub 编辑示意图 · 非报道原图

      Netskope 上线 AgentSkope Marketplace:用统一容量积分购买和调配安全、网络运维 AI Agent

      Netskope 的 AgentSkope Marketplace 已正式上线,把自家 SecOps 与 NetOps AI Agent 集中到一个目录中,企业可在同一控制台查看能力和成本估算,再用共享的 capacity credits 统一购买和动态调配额度。官方说明显示,积分不锁定单一 Agent,可在 DLP、Insider Threat、Private Access、Digital Experience 等不同 Agent 之间即时重新分配;Marketplace 还提供消耗率、预计用尽时间和容量预警。该模式主要改变 Agent 的采购、预算与治理方式,并不意味着企业可在平台中自由上传任意第三方 Agent。

    21. EasyHub 编辑示意图 · 非报道原图

      Cohere 发布 North 2:重做企业 Agent 编排,加入跨会话记忆、可复用自动化与细粒度成本治理

      Cohere 10 月 5 日发布 North 2,称这是 North 迄今最大的升级。新版本重做 Agent orchestration,可通过自然语言搭建更复杂的多步骤流程,并加入跨会话 Memory、Skills、Libraries、应用/文档生成和可共享 Automations。North 2 保持模型无关,可用 Cohere 模型或企业自带模型,并支持云、私有部署与隔离环境;North Admin 增加用户/Agent 级权限、请求与 token 限额、配额和组织级成本上限。它是企业 Agent 平台升级,不是一个新的基础模型。

    22. EasyHub 编辑示意图 · 非报道原图

      TikTok 公布 Shopping Assistant 与 Buy Direct:用对话式 Agent 找商品,并从 For You 信息流一键向品牌下单

      TikTok 10 月 5 日公布 Agentic Commerce 购物体验,核心包括 Buy Direct 与 Shopping Assistant。Buy Direct 让用户不离开 TikTok、直接从 For You 信息流向品牌一键购买;Shopping Assistant 是对话式 AI Agent,可记住当前对话中的购物需求,并给出商品、配送、尺码、库存等实时指导,帮助完成购买。TikTok 表示正与 Salesforce、Shopify、Shoplazza、Stripe 等合作建设这些能力;同批更新还包括 Agentic Leads 和面向美国广告主的 TikTok Ad Network,但本站把本条聚焦在购物 Agent 与直接结算。

    23. 来源页面配图:TechCrunch · 权利归原作者

      HackerRank 将 Chakra AI 面试官正式商用:Beta 已执行 50 万+ 场面试,重点评估判断力与 AI fluency

      HackerRank 10 月 5 日将 AI 面试 Agent Chakra 从约六个月 Beta 推向正式可用。候选人会在带真实代码仓库和 AI 助手的环境中完成任务,Chakra 根据过程追问并评估批判性思维、判断力和“AI fluency”,而不只看最终答案。HackerRank 官方页面称 Chakra 已执行超过 50 万场面试;TechCrunch 报道 Snowflake、Snorkel、Capgemini 等参与测试。HackerRank 同时强调 Chakra 生成评分/报告,但最终招聘决定仍由人类作出;关于偏差、可疑行为降低等效果数字属于公司数据,并非独立监管结论。

    24. 来源页面配图:Google Research · 权利归原作者

      Google Research 发布 Agentic Privacy & Security 开放问题框架:从系统、模型、用户与生态四层研究 Agent 的上下文边界

      Google Research 10 月 5 日发布一份由 50 多位学界和产业研究者协作形成的 workshop report,尝试用 Contextual Integrity 理论梳理通用自主 Agent 的隐私与安全开放问题。报告认为,Agent 为完成跨应用、多步骤任务往往需要访问个人数据并执行后果重大的动作,传统软件的权限与隔离思路不足以覆盖其上下文变化。作者将研究问题分布到系统、模型、用户与更广泛生态层,重点讨论如何表达行为规范、限制数据流与动作、识别跨上下文风险并在保持能力的同时建立可验证约束。它是一份研究议程,不是新的安全产品或已被证明有效的防护方案。

    25. 来源页面配图:TechCrunch · 权利归原作者

      Ghost 走出隐身并推出 Core:3499 美元本地个人 AI 电脑,获 a16z 领投 1100 万美元种子轮

      Ghost 10 月 5 日走出隐身,宣布由 Andreessen Horowitz 领投的 1100 万美元种子轮,并开放首款产品 Core 预订。Core 是一台无屏、面向常驻个人 Agent 的 3499 美元电脑,官方配置包括 NVIDIA RTX PRO 4000 Blackwell SFF 24GB、Ryzen 5 7600、64GB DDR5 与 1TB NVMe;Ghost 页面列出 Qwen 3.8-Next、Qwen 3.8-27B、Gemma 4-31B 和 Muse-Glimmer-30B 等本地模型。官方隐私说明称对话与记忆在设备上处理和保存。

    26. EasyHub 编辑示意图 · 非报道原图

      Lola Vision Systems 公开边缘 AI 编译工具链:把模型自动转换为特定芯片可执行指令,先靠现有硬件软件授权商业化

      TechCrunch 10 月 5 日介绍了华盛顿特区初创公司 Lola Vision Systems 的边缘 AI 基础设施方案。其核心产品是一套 compiler toolchain,把客户代码和 AI 模型转换成特定芯片可执行的指令,试图缩短把模型适配到新硬件上所需的手工调试时间。公司也在开发自有芯片,但为更早产生收入,现阶段会先把软件授权给现有硬件使用。Lola Vision 称已有 12 家企业签署未来芯片采购意向、1 家签约客户,累计融资略高于 100 万美元;这些商业数据均来自公司披露。

    27. EasyHub 编辑示意图 · 非报道原图

      ComfyUI v0.39.0 发布:接入 FLUX 3 Image、Sonnet 5.5、Ideogram 4.5,并新增离线模式控制

      ComfyOrg 于北京时间 10 月 6 日 06:49 发布 ComfyUI v0.39.0。该稳定版新增多组 Partner Nodes,包括 Anthropic Sonnet 5.5、Ideogram 4.5、HeyGen Video 1.0、Black Forest Labs FLUX 3 Image、Grok Imagine Video 1.5 Lite,以及 ElevenLabs v4/v4 Turbo;同时加入 --offline 与 --disable-partner-nodes 开关,并弃用旧的 --disable-api-nodes。版本还改进视频编码默认质量、EXR 16-bit float、模型资产扫描与锁竞争处理,并修复部分 MiniMax-H3、Qwen-Image-2.1 与集成 GPU 场景问题。这里记录的是 ComfyUI 自身稳定版更新,不代表这些外部模型都在 10 月 6 日首次发布。

    28. 来源页面配图:Cloudflare · 权利归原作者

      Cloudflare 总结 Birthday Week 2026:一周 46 项发布覆盖 AI Agents、开放源码、后量子安全与开发平台

      Cloudflare 10 月 5 日发布 Birthday Week 2026 总览,汇总此前一周分批公布的 46 项发布,范围包括 AI Agent 与开发平台、开放源码、后量子安全、网络与可观测性等。AI 相关项目包括面向 Agent 与模型调用的新能力,以及开发者基础设施更新。需要注意,这篇文章是 10 月 5 日的官方汇总,而不是声称 46 项产品都在当天首次发布;本站已单独收录的具体 Cloudflare 发布仍按各自原始日期计算。

    29. EasyHub 编辑示意图 · 非报道原图

      vLLM 0.31.0 发布:GPU 权重缓存支持快速重启,并加入初始化引擎快照与新一轮大规模推理优化

      vLLM 10 月 5 日发布 0.31.0,包含 717 个提交、307 位贡献者。新 vllm preload CLI 可启动 weight-cache daemon,让量化后的权重在 engine 重启间继续驻留 GPU;实验性的 vllm snapshot create/restore 使用 CRIU 恢复已初始化 TP1 engine。版本还扩展 Model Runner V2 speculative decoding、MoonEP/DeepEPv2 等大规模 serving、调度和 KV offload 控制,并重点优化 DeepSeek-V4.1-Flash、GLM-5.3-Flash、Kimi K3 等模型。官方同时列出多项 breaking changes,升级前需要核对量化和多模态参数。

    30. EasyHub 编辑示意图 · 非报道原图

      Iterate.ai 推出 Lifeboat:面向 Agent 长会话的推理引擎,主打更高 GPU 并发与机密计算

      Iterate.ai 10 月 5 日推出 Lifeboat,一款针对长时间、多轮 Agent 会话设计的推理引擎,加入公平调度、准入控制、缓存优化与机密计算,并提供 OpenAI 兼容 API。厂商宣称部分工作负载可把单 GPU 同时承载的 Agent 会话数提升 2–6 倍;其一项 RTX PRO 6000 Blackwell + Qwen 30B-A3B 测试记录了 2,048 个并发会话。性能数字来自厂商测试,不能外推为所有模型和硬件上的通用优势。

    31. EasyHub 编辑示意图 · 非报道原图

      Exa Places 上线:为 AI Agent 增加 2.11 亿地点结构化数据,所有 Search API 端点可直接使用

      Exa 10 月 5 日上线 Places 数据层,把约 2.11 亿个全球地点加入搜索索引,覆盖餐厅、博物馆、公园、商店和本地企业等。返回结果可包含名称、类别、地址、经纬度、营业时间、运营状态、电话、网站与评分等结构化字段,并已集成到 Exa 全部搜索端点且不额外收费。Exa 还公布了内部地点搜索基准,但这些 F1 对比属于厂商自测,不作为本站的跨产品排名结论。

    32. EasyHub 编辑示意图 · 非报道原图

      Bad Monkey AI 开源 AgentSpaces:用 P2P 协调让不同 AI Agent 共享任务结果并接管未完成工作

      Bad Monkey AI 在 10 月 5 日公开 AgentSpaces 0.2.0,一套 Apache 2.0 的 Agent 协调库。它采用 P2P 通信和带租约的 typed tuple space,让不同团队构建的 Agent、传统服务、机器人与传感器发现彼此、写入或领取任务、共享结果,并在 worker 失效后恢复未完成工作,而不依赖中央协调服务器。官方仓库描述其通过 CRDT gossip 复制协调状态,并提供 Java 组件及 Spring/Embabel 集成;发布报道还称提供 Python 支持。该项目更接近 Agent 协调基础设施,而不是新的通用 Agent 产品。

    33. EasyHub 编辑示意图 · 非报道原图

      Reactor 获 NVIDIA 与 Sapphire 加注:累计融资达 7400 万美元,专做实时 World Model 推理与流式基础设施

      Reactor 10 月 5 日宣布 NVIDIA 的 NVentures 与 Sapphire Ventures 加入其 Series A,累计融资达到 7400 万美元。公司并不训练自己的 World Model,而是提供面向实时生成视频和世界模型的推理引擎、GPU 云、流式层、SDK 与 API。Sapphire 介绍称,这类工作负载需要持续保持交互状态并把时延压到 50ms 以下;Reactor 已有 Overworld、Visko.ai、Moonlake.ai 等生产客户,并通过 AWS、Nebius 在美国、欧洲、日本和韩国部署算力。

    34. EasyHub 编辑示意图 · 非报道原图

      意大利总理 Meloni 为自己的声音申请欧盟商标:用知识产权工具增加 AI deepfake 滥用的法律阻力

      Reuters 10 月 5 日报道,意大利总理 Giorgia Meloni 向欧盟知识产权局申请将自己的声音注册为商标,材料包含一段四秒录音。其办公室确认申请的背景之一是 AI 生成 deepfake 与身份仿冒风险。报道同时指出,即使申请获批,也不会自动禁止所有 AI 模仿,但可能为未经授权复制声音增加额外法律障碍。本站把它作为生成式 AI 身份与内容来源治理案例收录,不把商标申请写成已经生效的全面 deepfake 禁令。

    35. EasyHub 编辑示意图 · 非报道原图

      LTM 与 Rubrik 推出 BlueVerse AgenTraceIQ:监控、治理并回滚企业 AI Agent 的误操作

      LTM 10 月 5 日推出 BlueVerse AgenTraceIQ,将 Rubrik Agent Cloud 与 LTM 的 AI 治理及托管服务结合,用于发现和监控企业 Agent、限制工具与数据访问、保留完整审计轨迹,并在 Agent 引发破坏性或非预期操作时恢复系统、数据、配置和代码仓库。产品还可把行为追溯到 prompt、执行计划和工具调用,支持 Copilot Studio、Agentforce、Amazon Bedrock Agents、Claude 方案及自建 Agent。

    36. EasyHub 编辑示意图 · 非报道原图

      Stellar Cyber 10 月 5 日集中公布 7.0 Agentic SOC 能力:自动分流、Case Metrics 与响应 API 一体化

      Stellar Cyber 10 月 5 日发布 7.0 系列正式市场公告,重点把 AI case analysis/auto-triage、Case Metrics、调查证据、自动响应集成和运维 API 组合成“Human-Augmented Agentic SOC”工作流。需要注意,Stellar 自己的技术 release notes 显示 7.0.0 的软件发布日期为 9 月 15 日,7.0.0s 则更早,因此本站把 10 月 5 日记录为 7.0 能力的正式集中公告与产品定位,而不是声称整个 7.0 软件当天首次出现。厂商关于生产率和误报改善的数字未作独立验证。

    37. EasyHub 编辑示意图 · 非报道原图

      Transcend 发布 Rails:用 Agent Policy-as-Code 在动作发生前实时允许、拒绝或升级审批

      Transcend 10 月 5 日发布 Rails,一套面向企业 AI Agent 的运行时 policy-as-code 控制层。企业可用自然语言定义业务规则,Rails 在 Agent 执行动作前实时返回允许、拒绝或升级人工审批,并提供责任人、完整审计轨迹和 kill switch。官方称它可覆盖 Claude、Cursor、Bedrock/AgentCore、Snowflake Cortex 等不同栈,并在 inference、工具调用、网络、记忆等环节实施策略。Rails 已在部分客户生产环境运行,同时开放 30 天试用候补。产品性能和节省比例属于厂商陈述,不作为本站独立验证结论。

    38. EasyHub 编辑示意图 · 非报道原图

      SafeWorld 走出隐身并获 1220 万美元种子轮:用仿真与人类行为模型压力测试生成式 AI 机器人

      SafeWorld 10 月 5 日走出隐身,宣布 1220 万美元种子融资,由 Shine Capital 与 a16z Speedrun 联合领投,Box Group、Carnegie Mellon University Endowment、Innovation Endeavors、SV Angel 等参投。公司由卡内基梅隆 Safe AI Lab 主任 Ding Zhao 与 Kyle Wong、Simo Rachidi 创立,面向 Physical AI/机器人提供安全测试与仿真工具:在不让真人承担风险的情况下生成危险和长尾场景、预测人机交互风险并保存评估证据。SafeWorld 表示已与多家大型企业进行机器人测试合作,但这些部署与效果仍属于公司披露。

    39. EasyHub 编辑示意图 · 非报道原图

      新加坡 DayOne 数据中心提交美国 IPO:上半年营收增至 5.12 亿美元,业务面向云计算与 AI 客户

      Reuters 10 月 5 日报道,新加坡 DayOne Data Centers 已提交美国 IPO 申请,计划以 DODC 为代码在纳斯达克上市。文件显示,公司 2026 年上半年营收为 5.12 亿美元,高于上年同期的 1.515 亿美元,同时净亏损扩大至 7720 万美元。DayOne 为云计算和 AI 客户提供数据中心空间、电力、冷却与连接,并已在马来西亚、印度尼西亚、泰国、香港、日本、芬兰和西班牙等市场运营。Reuters 此前报道称公司曾考虑最多融资 50 亿美元、潜在估值约 200 亿美元,但本次申请尚未披露最终发行规模。

    40. EasyHub 编辑示意图 · 非报道原图

      Physical AI 公司 RobCo 估值突破 10 亿美元:新投资与员工老股交易并行,计划明年推出 Alfie

      德国工业机器人公司 RobCo 10 月 5 日宣布估值超过 10 亿美元,较九个月前翻倍。本次交易同时包含对公司的新投资和员工二级股权出售,现有投资方 Sequoia、Lightspeed、Greenfield、Kindred、Lingotto、Promus Ventures 与 Cherry Ventures、European Tech Collective 等新投资者参与。RobCo 将自己定位为 Physical AI 工业自动化公司,其下一代双臂自学习机器人 Alfie 计划在 2027 年 3 月正式商业发布。

    41. EasyHub 编辑示意图 · 非报道原图

      Cohere 与 PwC 建立全球企业 AI 联盟:先从加拿大启动,主打安全私有部署与 Agent 落地

      Cohere 10 月 5 日宣布与 PwC 建立全球联盟,首站为加拿大,目标是帮助企业把 AI 从试点推进到生产。合作将 Cohere 的 North Agent 平台、企业模型以及搜索与检索能力,与 PwC 的行业、风险、监管、技术和转型服务结合,覆盖企业搜索、知识访问、深度研究、决策支持和任务自动化。官方列出的部署方式包括私有云、本地和隔离环境,重点是让受监管组织在扩展 AI 时保持对敏感数据与基础设施的控制。

    42. EasyHub 编辑示意图 · 非报道原图

      新加坡 OneByZero 获 2000 万美元 Series A:扩张亚太 forward-deployed AI,并加速 NEO 与 AI Coworkers

      新加坡企业 AI 公司 OneByZero 10 月 5 日宣布完成由 Jungle Ventures 领投的 2000 万美元 Series A,这是公司成立三年来首次外部融资。OneByZero 采用 forward-deployed engineering 模式,把工程师直接嵌入金融、电信和零售等大型企业,将 AI 接入既有系统并持续优化。资金将用于扩充亚太工程团队、进入日本,并加速 NEO 平台和 AI Coworkers;公司称过去三年营收每年增长超过一倍。

    43. 来源页面配图:Cognizant · 权利归原作者

      Cognizant 成立 Activate:面向年营收 10 亿至 50 亿美元企业提供预配置 AI、云与安全解决方案

      Cognizant 10 月 5 日宣布成立新的业务单元 Cognizant Activate,面向年营收约 10 亿至 50 亿美元、正在向 Global 2000 规模增长的企业。Activate 将提供数据与 AI、网络安全、企业应用、云现代化和托管服务的预配置方案,并用垂直整合团队和单一负责人缩短实施周期。首批聚焦金融服务、医疗、制造和零售/CPG;它是面向中大型成长企业的 AI 转型交付模式,而不是新的基础模型。

    44. EasyHub 编辑示意图 · 非报道原图

      Etched 据报收到 400 亿至 500 亿美元估值融资报价:新一轮谈判仍处早期,尚未敲定

      TechCrunch 10 月 5 日援引知情人士称,AI 推理芯片公司 Etched 在不久前以 210 亿美元估值完成 7 亿美元融资后,又收到按 400 亿至 500 亿美元估值投资的报价。报道强调谈判仍处早期,最终是否融资、金额和条款都可能变化,Etched 拒绝置评。公司今年已披露超过 10 亿美元客户订单,并在硅谷运营 10MW 数据中心、在台湾设立靠近台积电的生产协调设施。这里记录的是潜在新融资谈判,而不是一轮已经完成的融资。

    45. EasyHub 编辑示意图 · 非报道原图

      Vida 为 AI Agent 推出按结果计费:可按合格线索、暖转接、完成 onboarding 等验证结果付费

      Vida 10 月 5 日为其企业 AI Agent 推出 outcome-based billing,与传统按用量计费并行。客户可预先定义“完成工作的结果”,例如合格线索、暖转接、完成 onboarding 或挽回流失客户,平台按验证后的结果而不是 token、分钟或席位计费,并跟踪相应 KPI。该模式初期面向 performance marketing、保险等结果边界较清晰的行业。它是商业计费模型变化,不代表 Agent 本身突然获得新的基础模型能力。

    46. EasyHub 编辑示意图 · 非报道原图

      Collibra 收购 trail ML:把 Agent 自动化评估、持续合规与运行时策略阻断纳入 AI 治理

      Collibra 10 月 5 日宣布收购慕尼黑 AI 治理公司 trail ML,交易金额未披露。trail ML 的 Agent 可分析 AI 系统上下文、判断适用的法规/标准与控制项、持续检查证据和合规缺口,并在运行时直接执行 Collibra 策略,对违反规则的 Agent 动作进行阻断。Collibra 将其定位为从文档式治理转向持续、可执行治理的一步。

    47. EasyHub 编辑示意图 · 非报道原图

      Valon 获 1.5 亿美元 D 轮、估值 23 亿美元:推动 ValonOS 与 AI Agent 进入美国按揭服务流程

      Valon 10 月 5 日宣布完成 1.5 亿美元 D 轮融资、估值 23 亿美元,新投资方 Ribbit Capital 加入,Andreessen Horowitz 等既有投资者继续参与。公司把 ValonOS 定位为受监管金融的 AI-native 操作系统,在按揭服务中用 AI Agent 处理端到端工作流。Valon 称该平台开放给行业六个月内已签下超过 2 亿美元 contracted ARR,并已签约覆盖美国约六分之一的未偿按揭;这些规模数字来自公司披露,不能等同于独立审计或已确认收入。融资将用于产品开发、迁移大型服务商和扩充工程/部署/商业团队。

    48. EasyHub 编辑示意图 · 非报道原图

      EPAM 推出 Frontier AI 服务:为企业工作流生成高保真训练数据、模型评测与强化学习环境

      EPAM 10 月 5 日推出新的 Frontier AI 战略服务,目标是帮助前沿模型更可靠地完成复杂企业工作流。服务包括高保真训练数据生成、模型评测,以及用于多轮交互、推理和工具调用压力测试的定制强化学习环境。EPAM 表示其相关能力建立在与 Anthropic、OpenAI、Google 和 Microsoft 等实验室/平台合作基础上,并披露已培训近 1 万名 Claude 认证架构师、3000 多名 OpenAI 认证 forward-deployed engineers 和 5000 多名 Gemini 认证专家。

  4. 9 篇资讯
    1. 来源页面配图:Hugging Face · 权利归原作者

      Cantina 开放 apex-flash-1 安全研究模型:基于 GLM-5.3-Flash,用真实漏洞环境做强化学习后训练

      Cantina Security 与 Yeta Labs 推出 apex-flash-1,一款面向安全研究的开放权重模型,基于 GLM-5.3-Flash 并在由真实漏洞案例构造的隔离环境中进行 GRPO 强化学习后训练。首轮训练使用来自 50 个漏洞案例的 150 个任务;官方 held-out 评测为 20 个未见案例、60 个任务,apex-flash-1 完成 40/60,基座完成 36/60。上述成绩和成本均是 Cantina 自建环境中的内部评测,不代表通用网络安全能力排名;Hugging Face 权重采用 MIT 许可。

    2. EasyHub 编辑示意图 · 非报道原图

      Sam Altman:AI 应保持广泛可访问,巨大收益值得在治理中接受部分风险

      路透社 10 月 4 日报道,OpenAI CEO Sam Altman 在最新采访中主张 AI 应尽可能广泛可访问,而不是由单一实验室集中控制,并倾向较轻触式监管。他承认误用、诈骗等负面结果不可避免,但认为 AI 的社会与经济收益会显著超过风险。这是一项行业治理立场,不是新的模型或产品发布。

    3. EasyHub 编辑示意图 · 非报道原图

      Superagent 正式推出 Security-One 27B:开放 Apache 2.0 权重与 API,用概率做持续安全分流

      Superagent 10 月 4 日正式公布 Security-One 27B,一款面向持续安全分流的决策模型:对 prompt、Agent 工具调用、代码变更和告警返回预定义选项的概率,而不是自由文本,再由应用按阈值决定放行、升级到更强模型或交给人工。官方同时提供 Security-One API 与 Apache 2.0 权重。Superagent 自己的冻结 BIPIA 二分类测试中,在 0.70 阈值下检测到 599/600 个攻击并误报 1/200 个良性样本;这些是厂商自测,不应当作通用安全能力排名。其模型卡将底层模型 release date 标为 9 月 25 日,因此本站把 10 月 4 日记录为正式公开发布/API 与开放权重公告,而非声称 checkpoint 当天才产生。

    4. EasyHub 编辑示意图 · 非报道原图

      Scribe 推出 Optimize:实时观察企业工作流,定位低效环节并给出 AI 优化路径

      Scribe 10 月 4 日正式推出 Workflow AI 平台的新产品 Scribe Optimize。它把 Scribe 从“自动记录流程”扩展到“持续观察和优化流程”:在一个界面中聚合企业大量真实工作流,按步骤展示工作实际如何完成,并帮助团队识别瓶颈、重复动作与适合自动化或 AI 改造的部分。Scribe 表示产品已经投入客户使用;这是一款工作流可视化与优化产品,而不是自主替企业执行所有流程的 Agent。

    5. EasyHub 编辑示意图 · 非报道原图

      17 国在京都共同背书科研“Kyoto Vision”:提出扩大科研人员对 SI 工具、数据、算力与实验设施的访问

      10 月 4 日,美国、日本、德国、韩国、新加坡、英国、阿联酋等 17 国在京都举行的 Science and Technology in Society Forum 年会上共同背书《Kyoto Vision for a Golden Age of Science》。宣言把“Super Intelligence for science”列为重点方向,提出将 SI 更深入地用于科研流程,并扩大研究人员对相关工具、科学数据、计算基础设施和实验设施的访问,同时鼓励长期资助、快速资助、奖金挑战等多样化科研机制。该文件是一项国际共同愿景,并非具有强制执行力的监管条约。

    6. EasyHub 编辑示意图 · 非报道原图

      Google 暂停 OSS VRP 产品漏洞提交:自动化报告激增且绝大多数无效

      TechCrunch 10 月 4 日报道,Google 已从 10 月 1 日起暂停 Open Source Software Vulnerability Reward Program(OSS VRP)的新产品漏洞提交。Google 表示原因是自动化提交显著增加且“绝大多数无效”;已提交报告和供应链漏洞报告不受影响。公司计划重整这部分流程,并承诺在 2027 年第一季度给出更新。

    7. EasyHub 编辑示意图 · 非报道原图

      Schneider Electric 约 226 亿美元收购 PTC:加码数据中心与工业软件,应对 AI 驱动的数字基础设施需求

      Reuters 10 月 4 日报道,法国 Schneider Electric 同意以约 226 亿美元收购美国工业软件公司 PTC,这是 Schneider 迄今最大一笔交易。交易将把 PTC 的产品生命周期管理、工业软件与 Schneider 的能源管理、自动化和数据中心业务进一步结合。报道指出,数据中心扩张与 AI 相关需求是 Schneider 加大数字软件布局的重要背景,同时市场也在重新评估软件资产在 AI 时代的估值。交易仍需股东和监管批准,预计 2027 年第三季度完成。

    8. EasyHub 编辑示意图 · 非报道原图

      马斯克称 SpaceXAI 将更名为 SpaceXSI:跟进“Super Intelligence”表述,但尚未给出生效时间

      10 月 4 日,SpaceX CEO 埃隆·马斯克在 X 上回复用户称,公司将把 AI 业务单元 SpaceXAI 更名为 SpaceXSI,以采用“Super Intelligence”这一表述。Reuters 报道时,SpaceXAI 的 X 账号名称尚未改变,马斯克也没有给出具体切换时间或更多品牌调整细节。因此这条记录的是已公开确认的更名计划,而不是声称品牌迁移已经全部完成。

    9. EasyHub 编辑示意图 · 非报道原图

      川崎重工计划最早 2030 年让 Kaleido 人形机器人实现完全自主:拟接入日本 Noetra Physical AI

      日经 10 月 4 日报道,川崎重工计划最早在 2030 年推出能够完全自主运行的人形机器人,并把日本 Noetra 正在开发的 Physical AI 平台接入其 Kaleido 项目。Kaleido 自 2015 年起持续研发;这一新路线的核心变化是从依赖预设动作或远程操作,逐步走向由 Physical AI 进行环境判断和自主执行。2030 年是目标时间,而不是已经确认的量产交付日期。

  5. 11 篇资讯
    1. EasyHub 编辑示意图 · 非报道原图

      DeepSeek Harness v0.2.1-alpha.1 加入实验性 Claude Code Mods 兼容层,并让 Agent 可直接创建插件

      DeepSeek Harness 10 月 3 日发布 v0.2.1-alpha.1 预发布版,新增实验性的 Claude Code Mods 兼容层,用于验证 Claude Code Mods API 所提供的扩展能力是否大体属于 DSH“插件能力”的子集。官方明确强调当前目标不是提供完整、可直接迁移的 Claude Code Mods 兼容性,兼容文档也列出了桥接行为与 Claude Code 原生实现的差异。同一版本还在插件管理页加入“让 Agent 创建插件”入口,并增加 Web 的 --public-url、开发者工具组合包以及多项会话、桌面端和插件运行修复。

    2. EasyHub 编辑示意图 · 非报道原图

      OpenAI 安全负责人 David Robinson 离职公开发声:称前沿 AI 已不能再靠“先上线、出问题再修”

      前 OpenAI 安全团队负责人 David Robinson 10 月 3 日公开确认离职,并在《大西洋月刊》撰文批评前沿 AI 实验室过度依赖快速迭代和事后修补。他表示自己参与 Preparedness Framework 和多次模型安全报告,主张借鉴航空、核能等高风险行业的冗余安全体系,并在继续提升模型能力前投入更多安全研究。

    3. EasyHub 编辑示意图 · 非报道原图

      Gemini 10 月 9 日调整模型权限:免费用户只保留 Flash-Lite,AI Pro 新增 Deep Think

      Google 更新 Gemini 个人账户的模型访问规则:10 月 9 日起,无 AI 订阅的用户只保留 Flash-Lite,失去 Flash 与 Pro;AI Plus 将保留 Flash-Lite 和 Flash,但 Pro 会在邮件通知的日期移除。AI Pro 与 Ultra 继续保留三档模型,同时 AI Pro 也将获得此前更高档位才有的 Deep Think,并新增低、中、高 effort 选择。

    4. 来源页面配图:Microsoft · 权利归原作者

      Microsoft 与 Hugging Face 推出 ThinkingBox:不看 Agent 怎么说,直接检查它最终把系统改成了什么状态

      Microsoft 与 Hugging Face 10 月 3 日公开 ThinkingBox,用 507 个有状态工作流评测 AI Agent 是否真正完成任务。它不只检查回复文本,而是隔离运行 MCP 工具会话后直接核对数据库和系统副作用,并把每个任务重复运行 20 次,用 pass@1 与连续稳定完成能力区分“偶尔成功”和“可靠执行”。

    5. EasyHub 编辑示意图 · 非报道原图

      PydanticAI 2.54.0 发布:OpenAI Live 会话可断线恢复,GPT-Live 接入 WebSearchTool,并增强 Agent workspace 安全

      PydanticAI 于 10 月 3 日发布 2.54.0。OpenAILiveModel 现在可在断线后通过 fork 已保存 session 或重放历史恢复连接,GPT-Live 支持委托式 WebSearchTool;ExaSearch 与 YouSearch 新增 native 模式以优先使用模型原生网页搜索,clai2 加入双击 Esc 的 conversation rewind 菜单。版本还让 /update 安装最新构建后自动重启并恢复会话,并强化 shell realpath、LocalFileStore 所有权和 Bubblewrap/SSH workspace 边界,防止通过 symlink 或 shell startup files 越界执行。

    6. EasyHub 编辑示意图 · 非报道原图

      美国六家 AI 与芯片公司加入自愿安全承诺:包含内部控制与第三方审计,但没有强制处罚机制

      Reuters 10 月 3 日报道,美国政府与 Nvidia、SpaceX、OpenAI、Anthropic、Meta 和 Google 等六家公司公布一项 AI 自愿安全承诺,内容包括内部控制与第三方审计,但没有企业不遵守时的法定处罚或强制执行机制。报道将其放在美国关于 AI 风险、监管强度与产业竞争力的争论中,并引述支持者与批评者对“行业自律是否足够”的不同看法。本站把它作为 AI 治理事件收录,而不是把自愿承诺写成具有法律强制力的新监管制度。

    7. EasyHub 编辑示意图 · 非报道原图

      LiteLLM 1.104.0 强化代理网关安全:拒绝空/公开 master key,加入泄露密码检测与强制重置

      LiteLLM 10 月 3 日发布 v1.104.0,重点强化代理网关认证与凭据安全:启动时拒绝未设置、空值或公开已知的 master key;密码策略新增泄露密码检测、自助修改密码和管理员设置/泄露密码的强制重置。该版本还补回 MCP OAuth 与 credential isolation 回归测试,修复某些 worker 未先调用 tools/list 时 tools/call 返回 404 的问题,并通过 fal queue API 加入 Seedance 2.5 / 2.0 视频生成适配。它不是新模型发布,而是面向多模型代理网关的安全和 provider 能力更新。

    8. 来源页面配图:Aleph Alpha · 权利归原作者

      Aleph Alpha 开放 Kolibri 权重:78B 总参数、约 3B 激活,支持最长 100 万 token 上下文

      Aleph Alpha 10 月 3 日发布 Kolibri,一款英德双语 MoE 模型,拥有 78B 总参数、约 3B 激活参数,并支持最长 100 万 token 上下文。公司开放完整权重并采用 Apache 2.0 许可,称其训练流程覆盖数据整理、预训练、后训练与评测,并以较小激活规模面向可控部署与长上下文任务。

    9. 来源页面配图:PriceLabs · 权利归原作者

      PriceLabs 发布 Athena:主动巡检房源收益与动态定价,只有用户确认后才执行建议

      PriceLabs 10 月 3 日发布 Athena,一款内置于 PriceLabs 的主动式 AI 收益分析师。它会在后台对每个房源运行确定性的收益管理 Agent、定时 Routine 与用户定义 Skill,主动标出需要关注的定价和经营问题、解释原因,并给出可接受、复核或拒绝的建议。官方明确称 Athena 不会自行修改价格或设置,只有用户确认后才会执行;Beta 期间免费,并持续增加能力。

    10. EasyHub 编辑示意图 · 非报道原图

      Reuters 梳理 AI 万亿美元投入与回报压力:数据中心长期支出可能达 30 万亿美元,生产率兑现仍是核心问题

      Reuters 10 月 3 日发布专题,梳理全球 AI 基础设施投入正在达到历史罕见规模,以及这些资本最终必须由新的收入与生产率提升来支撑。报道引用 PwC 估算称,到 2050 年全球数据中心累计支出可能超过 30 万亿美元,并结合 Anthropic 等公司的长期算力承诺、美国 hyperscaler 资本开支和经济学家观点,指出当前真正的不确定性不是“是否继续投资”,而是广泛生产率收益能否足够快地出现。这是一篇产业经济分析,不是新的模型或产品发布。

    11. EasyHub 编辑示意图 · 非报道原图

      美国成立“Super Intelligence Force”AI 工作组:120 天内评估风险、机会与联邦政府角色

      路透社 10 月 3 日援引《华尔街日报》报道,美国白宫成立名为 Super Intelligence Force 的 AI 工作组,由国家情报总监 Jay Clayton 领导,并要求在 120 天内评估 AI 带来的风险与机会、现有事件报告机制以及联邦政府应承担的角色。Clayton 同时被描述为政府新的 AI 协调负责人。

  6. 21 篇资讯
    1. EasyHub 编辑示意图 · 非报道原图

      ChatGPT Finances 向美国 Free 与 Go 用户扩展,可连接账户与信用数据做财务分析

      OpenAI 10 月 2 日将 ChatGPT Finances 扩展至美国 Free 与 Go 用户,覆盖网页、iOS 和 Android。用户可通过 Plaid 连接金融账户、通过 Experian 接入信用报告,在聊天或面板中查看支出、账单、投资和信用分数;功能仅提供分析与规划,不能替用户转账、交易或支付账单。

    2. 来源页面配图:Anthropic · 权利归原作者

      Anthropic 推出 Claude Frontier Academy:投入 1 亿美元培养企业 AI 部署工程师

      Anthropic 推出 Claude Frontier Academy,并承诺投入 1 亿美元,目标在 2027 年底前培养 1 万名 Frontier Deployed Engineers。首个项目采用线下训练加 12 周驻留实践,首批参与方包括咨询公司、金融机构与 Novo Nordisk,现已在旧金山、纽约和伦敦运行。该项目并非面向公众自由报名,当前主要通过企业或合作伙伴提名参与。

    3. EasyHub 编辑示意图 · 非报道原图

      Meta 公布 Muse Spark 数学研究协作:六篇论文中五篇回答此前开放问题,研究者全程指导与复核

      Meta AI 10 月 2 日公布一组数学研究协作成果:数学家通过普通 meta.ai 界面使用 Muse Spark 1.1 与 1.2 Thinking Mode,共形成六篇论文,其中五篇给出对此前开放研究问题的回答。Meta 强调研究问题由数学家选择和推进,另有独立数学家复核,论文也区分主要由人类与 AI 起草的段落;部分问题后来还出现外部团队独立解法,因此这不是“AI 单独解决六道开放题”的自主研究宣称。

    4. EasyHub 编辑示意图 · 非报道原图

      SGLang v0.5.21 发布:新增 Decisions / Score API,PD 实例可动态切换,前缀缓存默认迁到 Rust

      SGLang 10 月 2 日发布 v0.5.21,汇集 779 个 PR、227 位贡献者。新版本新增 /v1/decisions 与 /v1/score,可把 LLM/VLM 用作低延迟分类器、打分器;prefill/decode 实例可无需重启动态换角色,prefix cache 默认改用 Rust 核心。官方还加入 DeepSeek-V4.1 Flash、MiMo-V2.6、Qwen-Image 2.1、FLUX 3 Action 等模型支持,并报告 DeepSeek-V4.1 长提示首 token 最多快 22%、Kimi K3 PD serving prefill 吞吐提升 20.6%;这些性能数字属于项目自测。

    5. EasyHub 编辑示意图 · 非报道原图

      阿里云 Model Studio 上线 Qwen‑Image‑2.1‑Pro:7B 视觉生成组件支持透明图与最多 10 张参考图编辑

      阿里云 Model Studio 的国际区模型更新表显示,10 月 2 日新增 `qwen-image-2.1-pro`。官方把它定位为兼顾生成质量、推理效率与成本的 Qwen 图像模型:视觉生成组件仅 7B 参数,统一文本生图与图像编辑,原生支持生成/编辑透明图、从照片提取主体,并可使用最多 10 张参考图做局部编辑与人物/商品保持。官方还强调字体、肖像光照和纹理细节改进。这里记录的是 Model Studio 国际区新增可调用模型,不把它与更早发布的 Qwen‑Image‑3.0 系列混为一次旗舰换代。

    6. EasyHub 编辑示意图 · 非报道原图

      Ai2 开源 AstaBrief 8B:把科研检索结果快速生成带引用报告

      Ai2 开源 AstaBrief 8B 及训练数据,并把它作为 Asta「Generate a report」的 Fast 模式。模型基于 Qwen3-8B,输入研究问题和已检索的文献片段后一次生成带引用报告,也可由机构部署在自有基础设施。Ai2 报告其完整流程平均约 51.1 秒,而 Claude 驱动的 Thinking 模式约 178.5 秒;官方同时强调主要评测在 2025 年完成,不能视为对当前前沿模型的最新排名。

    7. 来源页面配图:GitHub · 权利归原作者

      GitHub Copilot Code Review 开放 API 调用,并把 Balanced 设为默认审查强度

      GitHub 10 月 2 日为 Copilot Code Review 增加 REST 与 GraphQL API,可从脚本、工作流或内部工具主动请求代码审查,并可按次指定审查强度。GitHub 同时确认 Default 已从 9 月 28 日起采用 Balanced;此前显式选择 Lite 的设置不受影响。API 能力已面向 Copilot Pro、Pro+、Max、Business 与 Enterprise 正式提供。

    8. EasyHub 编辑示意图 · 非报道原图

      Cactus 发布 16.9MB 端侧语音识别模型 Whistle:7 种语言可在 CPU 本地转写

      Cactus Compute 10 月 2 日发布开源语音识别模型 Whistle。官方提供的单文件运行格式为 16.9MB,可在 CPU 上通过与 Needle 共用的 C++/WebAssembly 引擎本地运行,无需把音频发送到云端;支持英语、德语、法语、西班牙语、意大利语、荷兰语和波兰语,并提供词级时间戳与语音 embedding。Hugging Face 模型卡采用 Apache 2.0 许可。

    9. EasyHub 编辑示意图 · 非报道原图

      Meta Muse 开放 Gadgets 硬件入口:ESP32 与 Linux SDK 可把个人 Agent 接入屏幕、传感器和家居设备

      Meta 10 月 2 日为 Muse 推出 Gadgets 计划,开放 ESP32 Device SDK、Linux Device SDK 和相关固件源码,让用户把 Muse 接到屏幕、麦克风、传感器、执行器、Raspberry Pi 与本地 HTTP 设备。官方代码采用 Apache 2.0;同时提供 Muse Home Link 作为自有硬件示例,美国活跃 Muse 订阅用户可申请一台,10 月起陆续发货。

    10. 来源页面配图:Google · 权利归原作者

      Google 将联邦学习迁入 TEE:Gboard 训练获得可外部验证的差分隐私保证

      Google Research 10 月 2 日公布新的联邦学习系统,把更多训练计算转移到可信执行环境(TEE)中的服务器侧,同时保留对用户数据的隐私约束。该系统为中心差分隐私提供可外部验证的保证,并已用于 Gboard 场景;Google 表示这种设计还可提升训练速度、模型精度和可覆盖设备范围,把“隐私承诺”进一步变成可审计的系统属性。

    11. EasyHub 编辑示意图 · 非报道原图

      GIGABYTE 发布 AI TOP ATOM 64GB:Grace Blackwell 桌面 AI 设备新增更低容量版本,10 月 23 日开售

      技嘉 10 月 2 日发布 AI TOP ATOM 的 64GB 统一内存版本,在现有 128GB 机型之外提供更低容量选择。设备基于 NVIDIA GB10 Grace Blackwell Superchip,官方标称 FP4 AI 算力最高 1 petaFLOP,并保留 ConnectX-7 高速网络,可通过 NVIDIA Sync 连接最多四台设备。64GB 版本计划 10 月 23 日上市,定位本地模型开发、原型验证和桌面级 AI 工作负载。

      核对 阅读原文
    12. EasyHub 编辑示意图 · 非报道原图

      NVIDIA 公布 64GB 版 DGX Spark:10 月 23 日起售,双机可聚合至 128GB

      NVIDIA 10 月 2 日公布 64GB 版 DGX Spark,将于 10 月 23 日开售,起价 4,999 美元。官方称单机可运行最高 100B 参数模型;两台可借助 Sync Cluster Assistant 聚合为 128GB,并扩展到最高 200B 参数模型。官方所称最高 1.7 倍性能提升来自其自测。

    13. EasyHub 编辑示意图 · 非报道原图

      MCP TypeScript / Python SDK 2.3.0 发布:收紧跨域跳转与令牌 audience,并给大 SSE 工具结果加资源上限

      Model Context Protocol 的 TypeScript 与 Python SDK 在 10 月 2 日相继发布 2.3.0。TypeScript SDK 默认只跟随同源重定向,新增 maxToolInputElements 和 OAuth expectedResource audience 校验,并要求 stateless Streamable HTTP 按请求创建 server/transport;项目测试称 50–100MB 单个 SSE 工具结果的接收时间与峰值内存显著下降。Python SDK 同时加入 max_sse_event_size、可关闭 subscriptions/listen、HeaderMismatch 自动重试一次,并强化 x-mcp-header 注册校验和 OAuth 登录超时处理。这是 SDK 行为与安全边界升级,不是 MCP 协议本身发布新版本。

    14. 官方项目分享图:WordPress · 权利归原作者

      WordPress 官方 MCP Adapter 0.7.0 进入插件目录:把 Abilities API 暴露为 MCP tools、resources 与 prompts

      WordPress AI 团队 10 月 2 日发布 MCP Adapter 0.7.0,并将其作为官方插件提供。MCP Adapter 用来桥接 WordPress Abilities API 与 Model Context Protocol,让 AI Agent 通过标准 MCP 发现并调用 WordPress 核心、插件和主题提供的 abilities,并映射成 tools、resources 或 prompts。0.7.0 同时收紧协议兼容范围,仅服务 2025-11-25 与 2026-07-28 两个 MCP schema revision。它不是 WordPress 核心自动开启 Agent 权限,而是一个需要站点管理员部署和配置的适配层。

    15. 来源页面配图:OpenRouter · 权利归原作者

      OpenRouter 拆解多模型 Agent 三层路由:编排、模型选择与提供商路由各自独立

      OpenRouter 10 月 2 日发布对 LangChain/LangGraph、CrewAI 与 OpenRouter 原生路由的对照说明,将常被混称为“多模型编排”的能力拆成三层:工作流编排负责状态、规划、记忆和委派;模型路由决定某次调用使用哪个模型及失败回退;提供商路由决定同一模型由哪个后端服务。文章强调 OpenRouter 的 `models` 列表回退是错误驱动,不会自动判断回答质量;LangGraph 或 CrewAI 仍适合需要持久状态、人工审核和多 Agent 协作的场景。

    16. 来源页面配图:Cloudflare · 权利归原作者

      Cloudflare 推出 Web Search API:AI Gateway 可直接调用 Exa、Linkup 与 Ceramic.ai 获取实时网页上下文

      Cloudflare 10 月 2 日为 AI Gateway 推出 Web Search API,首批接入 Ceramic.ai、Exa 和 Linkup。开发者可通过 AI Gateway、标准 REST API 或 Workers binding 获取实时网页搜索结果,并复用 Gateway 的日志、统一计费、访问控制与 BYOK;Cloudflare 还要求合作搜索爬虫满足 Verified Bot、robots.txt 与来源链接规则。

    17. 来源页面配图:OpenRouter · 权利归原作者

      OpenRouter 上线 Model Router Benchmarks:统一比较模型路由器的质量、速度与成本

      OpenRouter 10 月 2 日上线 Model Router Benchmarks 页面,把不断增多的模型路由器放到同一套基准下比较质量、速度和成本,并同时展示高性价比与高智能单模型作为参照。OpenRouter 表示会持续加入新的 router 并更新成绩,因此这些分数应理解为动态公开测试结果,而不是永久排名。

    18. 来源页面配图:Supabase · 权利归原作者

      Supabase 把后端搬进代码与 Agent 工作流:无 Docker 本地栈、Compute 与应用级 MCP Server 同步亮相

      Supabase 10 月 2 日在 Select 2026 公布一组面向 coding agent 的后端能力。Schema 与项目配置现在可以放进仓库,由 pg-delta 从声明式 SQL 生成 migration;实验性的本地栈可直接以原生进程运行,不要求 Docker,并支持按目录或 worktree 启动多个隔离实例。Supabase Compute 进入私有 Alpha,可在数据库旁运行不限时长的 Linux 服务和 Agent;应用还可以部署自己的 MCP Server,让 Claude、ChatGPT、Cursor 等 Agent 以已登录用户身份调用工具,并继续受 Supabase Auth 与 RLS 权限约束。

    19. 来源页面配图:Apple · 权利归原作者

      Apple 将收紧 macOS Full Disk Access:AI Agent 需通过更明确的用户授权

      Apple 10 月 2 日宣布将为 macOS Full Disk Access 增加额外控制,要求用户通过更明确的操作才能授予这一级别的权限。Apple 指出该权限可能让应用读取文件、邮件、消息和浏览历史,而随着 AI Agent 更自主,这类广泛访问的风险会进一步上升。公告尚未给出具体系统版本或实施时间,因此目前属于已确认的安全策略调整计划,而非已经全面上线的权限机制。

    20. EasyHub 编辑示意图 · 非报道原图

      FieldAI 签署新融资 term sheet:拟募资 7 亿美元、估值 100 亿美元,押注通用机器人“大脑”

      Business Insider 10 月 2 日报道,Physical AI 公司 FieldAI 已签署一份拟融资约 7 亿美元、估值约 100 亿美元的 term sheet。该交易尚未正式 closing,领投方也未披露,因此不能写成“已经完成 7 亿美元融资”。FieldAI 开发可跨人形机器人、机器狗、无人机和工业 rover 使用的通用自治软件,并称自 6 月以来新增至少 3500 万美元收入与客户合同,总额超过 1.35 亿美元;这些商业数据同样来自报道所引消息人士。

    21. 来源页面配图:Supabase · 权利归原作者

      Supabase 宣布收购 Turso:让 Agent 按需创建轻量 SQLite 数据库,并在增长后衔接 Postgres

      Supabase 10 月 2 日宣布收购 Turso,目标是为 Agent 大规模创建短生命周期数据库建立新的数据基础设施。Turso 用 Rust 重写 SQLite,并构建了可在单台服务器管理数百万数据库、按需加载和休眠实例的云架构;Supabase 表示 Turso 会继续推进 SQLite,Supabase 继续围绕 Postgres 建设,同时把两者连接成从 Agent 原型到生产负载的演进路径。Turso 团队将加入 Supabase,联合创始人 Glauber Costa 负责这项 agentic infrastructure 工作。官方没有在公告中披露交易金额。

本页 6 个日期 · 281 篇,同一天的资讯不拆页

有明确时刻的资讯按所选时区归档;仅标日期的文章保留原日期。同日仅日期条目列在有明确时刻的条目之后,不虚构先后顺序。核对日期使用 UTC。