EASYHUB JOURNAL / 2025-05
2025年5月 AI 资讯
16 篇选读,按原文日期从新到旧。点击标题查看摘要、配图及原文链接。
- 新京报
通义灵码发布独立 AI IDE,结合工程上下文与 MCP 工具
通义灵码 AI IDE 集成原有插件能力,并加入可检索工程、执行终端和调用 MCP 的编程智能体。开发者可用自然语言提出任务,结合行间建议、会话与工程记忆持续修改项目;外部工具调用和终端执行仍需在用户授权的环境内进行。
- Tencent
HunyuanVideo-Avatar 开放音频驱动角色视频生成
HunyuanVideo-Avatar 以角色图片和音频生成说话、演唱等视频,研究重点包括角色外观一致性、情绪表达与更大范围的身体动作。项目开放推理代码和模型权重,便于创作者接入制作流程;它生成的是视频片段,不是摄像头实时动捕软件。
- IT之家
Gemma 3n 展示面向移动设备的多模态模型设计
Google 在 I/O 介绍 Gemma 3n 的低内存设计,结合分层嵌入等方法面向本地体验。模型总参数、有效内存及预览可用性是不同指标,需分别核对。
- IT之家
腾讯云将知识引擎升级为智能体开发平台
腾讯将大模型知识引擎升级为智能体开发平台 TCADP,接入 DeepSeek-R1、V3 和联网搜索,面向企业构建能检索知识与调用模型的应用。同期提及的世界场景、企业及端侧混合推理模型开源属于后续计划,与已经发布的平台功能分别说明。
- IT之家
Stitch 用文字和草图生成界面,并衔接 Figma 与前端代码
Google Labs 推出实验工具 Stitch,可从英文描述、截图或线框图生成界面,再通过对话调整布局和主题。结果可粘贴至 Figma 继续设计,或导出前端代码,缩短设计到实现的交接;它输出的是界面层,不代表后端、数据库和业务测试已经完成。
- IT之家
GitHub 编程智能体将分配任务转为待审核代码变更
GitHub 将任务分配、仓库环境和代码变更审核串成智能体流程,支持根据评论继续修订。自动生成 PR 不代表无需代码审查,执行日志与测试仍是交付依据。
- IT之家
Windows AI Foundry 整合本地模型与推理工具链
微软在 Build 介绍本地 AI 平台、模型选择及 Windows 推理运行时,面向 CPU、GPU 和 NPU。各 API 和硬件支持有不同预览阶段,不能由统一名称推断全部功能已普遍可用。
- Google
Google Flow 将视频模型与镜头、角色和场景管理整合
Flow 把 Veo、Imagen 与 Gemini 接入视频创作工作台,支持管理角色和场景素材、调整镜头并续接片段,帮助把零散生成结果组成故事。首发面向美国的 Google AI Pro/Ultra 用户,Veo 3 原生音频等能力与当时的套餐和开放范围有关。
- The Verge
NotebookLM 移动应用把资料阅读与音频概览带到手机
NotebookLM 将资料问答与音频概览带到 Android、iOS 和 iPadOS,支持导入来源并后台或离线收听音频。移动端方便在通勤或阅读间隙继续处理资料;生成的概览仍以用户提供的材料为基础,不等于原始信息已经被独立核实。
- IT之家
云端 Codex 研究预览让编码任务在隔离环境执行
报道介绍云端 Codex 在独立环境读取仓库、修改代码和运行测试,并通过日志交付结果。这是与本地 CLI 不同的产品形态,发布时的访问和联网限制需按当时版本理解。
- IT之家
混元图像 2.0 上线实时绘画板,支持边修改边预览
混元图像 2.0 在官网开放注册体验,输入或修改提示词时可连续预览生成效果。新增实时绘画板能随线稿和参数变化生成上色结果,也支持把多张草图放入同一画布融合创作;这篇报道对应在线产品开放,并非模型权重开源公告。
- Notion
Notion 把会议纪要、跨应用搜索与研究模式整合进工作区
Notion AI for Work 新增会议转写与待办整理,可跨工作区和已连接的应用查找资料,再通过研究模式组织成文档。会议笔记和研究模式先行可用,企业搜索与部分连接器逐步上线,减少团队在会议记录、聊天与项目文档之间反复切换。
- IT之家
HunyuanCustom 开放参考主体视频生成,保留身份并改变场景
HunyuanCustom 使用图片提供人物或物体的身份,再由文字指定动作、服饰和场景,用于连续角色视频等创作。此次先开放单主体生成及线上体验;多主体、音频驱动和视频局部编辑是同批介绍的扩展能力,当时报导称其余部分将在后续陆续开源。