新闻动态
2025年8月4日
阿里开源 Qwen-Image:20B 参数,把"文字渲染"做成图像模型的主场
阿里通义千问 2025 年 8 月 4 日发布 Qwen-Image,一个 20B 参数的 MMDiT 图像基础模型,在复杂文本渲染(多行排版、段落语义、细粒度细节)上取得突破,支持中英文等多种语言,于 GitHub、Hugging Face、ModelScope 开源。
来源:Qwen 官方博客
2026年7月21日
Qwen-Image-3.0 发布:第三代图像基础模型,主打一个"实"字
阿里通义千问 7 月 21 日发布 Qwen-Image-3.0,官方以"实"概括三代演进:内容丰实(4.5k token 输入)、细节真实、知识厚实;2026 年 Qwen 正以图像、世界模型、具身智能密集铺开研究版图。
来源:通义千问官方
2025年8月19日
Qwen-Image-Edit 开源:双路控制架构,让"改图中的字"不再返工
阿里通义千问 2025 年 8 月 19 日发布 Qwen-Image-Edit,基于 20B Qwen-Image 构建,通过 Qwen2.5-VL(视觉语义控制)+ VAE 编码器(视觉外观控制)的双路架构,实现"语义编辑 + 外观编辑"兼顾,支持精确的图中文字编辑。
来源:Qwen 官方博客
2026年6月9日
重新认识 Poe:AI聊天助手工具的核心能力
Poe 是 Quora 旗下的 AI 聊天聚合平台,支持 Claude、GPT-4、Gemini、Llama 等数百个 AI 模型,可在单一界面切换使用,支持自定义机器人创建与分享。
来源:Poe 官方文档
Pi 能力解析:AI聊天助手场景怎么用
Pi 是 Inflection AI 开发的个人 AI 助手,以情感共情、温暖对话风格和深度倾听著称,由 Reid Hoffman 和 Mustafa Suleyman 创立。
来源:Pi 官方文档
Pika 怎么用:Pika Labs 推出的 AI 视频生成与
Pika 是 Pika Labs 的 AI 视频生成平台,主打 Pikaffects 创意特效、Scene Ingredients 多素材合成与 Lip Sync。本文梳理其能力、定价与典型应用场景。
来源:Pika 官方文档
Phoenix 功能拆解与适用场景梳理
Phoenix 帮助团队建立 Agent 观测与评测闭环,支持本地、Docker、Kubernetes 与云端部署,适合持续迭代的 AI 产品团队。
来源:Phoenix 官方文档
Perplexity 产品观察:AI搜索方向的能力盘点
Perplexity 是由 Aravind Srinivas 等人创立的 AI 原生搜索 / 回答引擎,提供 Web、iOS、Android、桌面、Comet 浏览器与 Sonar API。
来源:Perplexity 官方文档
Phind 功能拆解与适用场景梳理
Phind 是专为开发者设计的 AI 搜索引擎,结合实时网络搜索与 LLM 推理生成带代码示例的技术答案,支持 Web、API 和 VS Code 插件,免费版可用,Pro 版 $17/月。
来源:Phind 官方文档
Otter.ai 怎么用:领先的 AI 会议转录与笔记助手
Otter.ai 是 AI 会议转录与笔记助手,实时转录 Zoom、Teams、Google Meet 会议,自动生成摘要和行动项,支持对话式问答。免费版 300 分钟/月,Pro 版 $16.99/月。
来源:Otter.ai 官方文档
一文看懂 Originality.AI:专为内容营销与 SEO 团队设计
Originality.AI 是专为内容营销和 SEO 团队设计的 AI 检测与抄袭检测平台,由加拿大团队创立,支持 GPT-4、Claude、Gemini 输出识别,提供可读性评分和团队协作功能。
来源:Originality.AI 官方文档
重新认识 Opus Clip:AI视频工具的核心能力
Opus Clip 用 AI 自动从长视频中提取最具传播力的片段,自动添加字幕、重构画面至 9:16,快速生成适合 TikTok、Reels、YouTube Shorts 的短视频,1M+ 用户在用。
来源:Opus Clip 官方文档
Obviously AI 功能拆解与适用场景梳理
Obviously AI 是无代码预测分析平台,上传 CSV 文件即可自动完成特征工程、模型训练和预测部署,支持客户流失预测、销售预测等业务场景,面向非技术业务团队,定价从 $75/月 起。
来源:Obviously AI 官方文档
Ollama 产品观察:AI模型训练方向的能力盘点
Ollama 是 GitHub 173K+ Star 的开源本地大模型运行工具,一行命令在 macOS/Windows/Linux 运行 Llama、DeepSeek、Qwen 等模型。
来源:Ollama 官方文档
一文看懂 NotebookLM:Google 基于 Gemini 的研究与笔
NotebookLM 是 Google 基于 Gemini 的 AI 研究与笔记助手,可将用户文档、网页与视频整合为可对话的知识库。本文梳理其功能、定价与场景。
来源:NotebookLM 官方文档
Notion AI 产品观察:AI办公与效率方向的能力盘点
Notion AI 将 LLM 能力深度嵌入团队文档与数据库,提供智能体、跨应用搜索、会议记录与流程自动化。本文梳理其能力栈、定价与适用场景。
来源:Notion AI 官方文档
2026年7月14日
OpenAI API 1.0 公测发布:多模态能力矩阵成型,开发者平台的"配置化"交付更进一步
OpenAI API 于 2026-07-14 进入 1.0 公测阶段,以多模态能力矩阵覆盖文本、图像、语音与嵌入向量,为开发者提供从旗舰高精度到轻量低成本的模型梯度。
来源:OpenAI 官方发布