新闻动态
2026年6月16日
Jasper GEO Agent:为 AI 搜索可见性而生的营销新基建
Jasper 6 月 16 日发布 GEO Agent 与 GEO Hub,构建面向 AI 搜索优化的端到端体系;品牌可监测在 ChatGPT、Perplexity、Google AI Overviews 中的被引率并生成"AI 真正会引用"的内容。
来源:Jasper 官方博客
2026年7月31日
即梦 AI 上手:字节视频生成旗舰的创作入口,30 秒长叙事怎么玩
即梦 AI 是字节跳动的 AI 智能创作工具,提供文生图、图生图、文/图生视频与智能画布能力;7 月 31 日随 Seedance 2.5 上线 30 秒长叙事视频生成,是字节视频旗舰能力的首发平台。
来源:即梦AI 官方
Grammarly 新增 5 种语言,AI Detector Agent 登顶质量榜
Grammarly 将 AI 写作辅助扩展至英语之外 5 种新语言,其 AI Detector Agent 在质量评测中登顶;隶属 Superhuman 平台后,正从语法检查扩展为覆盖写作、检测与治理的企业工具集。
来源:Grammarly 官方博客
Gemini 七月盘点:Spark 深度绑定 Chrome、macOS 自然语言与东南亚本地化
Google 7 月为 Gemini 交付一批更新:Spark 与 Chrome 深度集成、macOS 端新增自然语言操作,并发布《Gemini 东南亚 2026 报告》展示本地化策略;AI 助手正从独立应用走向系统级入口。
来源:Google 官方博客
Figma Config 2026 盘点:Make、Motion、Weave 与设计 Agent 的全面进化
Figma 年度大会 Config 2026 发布 Figma Make、Figma Motion、Weave、shaders 与扩展的设计 Agent;7 月 31 日 Make 进一步推出属性面板与标注功能,弥合设计与代码之间的鸿沟。
来源:Figma 官方博客
豆包专业版接入 Seedance 2.5:字节大众产品与企业 AI 的双向奔赴
字节 7 月 31 日发布 Seedance 2.5 视频生成模型并上线豆包专业版,豆包用户在对话场景即可获得高质量 AI 视频生成能力;这背后是字节 AI 资源分配从大众产品向企业服务倾斜的调整。
来源:豆包官方 / IT之家
2026年6月11日
Snyk 宣布收购 Invariant Labs,将 Agent 安全能力整合进开发者安全平台
Snyk 宣布收购 Invariant Labs,后者是专注 AI Agent 安全的工具厂商,产品线包括 Guardrails、Explorer 和 MCP Scan。
来源:Invariant Labs 官方
E2B 完成 2100 万美元 A 轮融资:AI 沙箱执行量突破 10 亿次,Fortune 100 客户覆盖 94%
E2B 宣布完成 2100 万美元 A 轮融资,同期披露累计启动沙箱 10 亿次、Fortune 100 客户覆盖率 94%、月均 SDK 下载 350 万次等核心规模数据。
来源:E2B 官方
2026年8月2日
华为小艺接入 GUI 操作:从语音问答到直接操控支付宝与淘宝
华为小艺接入 GUI 操作能力,支付宝与淘宝等应用可被助手直接调用,AI 助手从语音交互向应用控制(端侧 Agent)演进。
来源:用户供稿
2026年7月28日
Grok Build Mode 与插件市场:xAI 的编码 Agent 走向平台化
xAI 7 月 28 日发布 Grok Build Mode,为编码 Agent 增加新的工作形态;配合 Workflows、Agent Dashboard 与插件市场,Grok Build 正从 CLI 工具走向"模型+Agent+开放生态"的平台。
来源:xAI 官方新闻
2026年4月8日
HeyGen 发布 Avatar V:"世界上最逼真的 AI 数字人"背后是身份优先战略
HeyGen 4 月 8 日发布 Avatar V,官方称其为"世界上最逼真的 AI 数字人模型",在真实感、口型同步、表情与动作自然度上实现代际提升;与前一日引入的 Seedance 2.0 形成"数字人 + 视频生成"组合。
来源:HeyGen 官方博客
2026年6月2日
Copilot app 的生态账本:跨设备会话、按 API 计费与自定义 Agent
Build 2026 上 GitHub 推出 Copilot app 桌面体验的同时,重构了开发者生态:跨设备会话延续、20+ 模型 harness 选择、按 API 计费与 Copilot Pro+,将 Copilot 从结对程序员推向同侪程序员。
来源:GitHub 官方博客
2026年8月3日
谷歌 Gemini Spark 个人 AI 智能体向全球大部分地区开放,深度整合 Chrome
7月31日,谷歌宣布 Gemini Spark 个人 AI 智能体向全球大部分地区开放,可自动整理收件箱、取消订阅、代搜航班订票,并已整合 Chrome。
来源:用户供稿
谷歌 DeepMind 发布 Gemini Robotics 2:通用 AI"大脑"数小时适配新机身
谷歌 DeepMind 发布 Gemini Robotics 2 系列通用 AI"大脑"智能套件,三款模型跨机型适配不同硬件躯体,数小时数据训练即可适配全新机身,定位机器人"智能层"供硬件厂商开发。
来源:用户供稿
2026年7月24日
Gemini Spark 深度集成 Chrome:浏览器成为 AI 助手的"主战场"
Google 7 月发布 Gemini Spark 的 Chrome 深度集成更新,用户可直接在浏览器中调用 Gemini 处理网页内容、提炼信息与执行任务;浏览器作为 AI 入口的争夺在 2026 年显著升温。
来源:Google 官方博客
2026年7月9日
GPT-5.6 接入 Figma Make:设计到代码的最后一公里被提速
Figma 7 月 9 日宣布 OpenAI GPT-5.6 可在 Figma Make 中使用,以准确的首次生成与快速迭代为开发构建提供起点;配合 MCP Server 与 Make,Figma 正演变为设计与开发之间的 AI 基础设施。
来源:Figma 官方博客
2026年7月21日
Gemini for macOS 新增自然语言能力:桌面 AI 从"对话框"走向"系统级助手"
Google 7 月为 Gemini for macOS 推出新自然语言能力,用户可用直接语音/自然语言指令与桌面应用交互,标志 Gemini 桌面端从"聊天窗口"向"操作系统级 AI 助手"演进,与 OpenAI、Anthropic 争夺桌面 AI 入口。
来源:Google 官方博客
2025年11月17日
ElevenLabs 发布 Image & Video:语音龙头杀入视觉生成
ElevenLabs 2025 年 11 月 17 日发布 ElevenLabs Image & Video,标志这家语音 AI 公司正式进入图像与视频生成领域,从"语音单模态"扩展为"多模态创作平台",用户可在同一平台完成图像、视频与语音协同创作。
来源:ElevenLabs 官方博客
2026年6月17日
2026年6月18日
DeepSeek 识图模式正式上线:多模态能力产品化迈出关键一步
DeepSeek 识图模式在网页和App端正式上线,采用 Thinking with Visual Primitives 框架,与"快速模式""专家模式"并列,标志着多模态能力从研发进入产品化阶段。
来源:IT之家