Imported from brantzh6/aliyun-model-skills (
aliyun-bailian-doc-research/SKILL.md). Install upstream withnpx skills add brantzh6/aliyun-model-skills --skill aliyun-bailian-doc-research. Copyright stays with the author.
阿里云百炼文档研究 — 抓取与更新指南
版本: v5.4 更新时间: 2026-08-24 适用场景: 抓取阿里云百炼平台最新文档,生成结构化的本地 SKILL.md 文档
🎯 目标
从官方文档抓取最新信息,生成 output/{类别}/SKILL.md 文件。
🔗 根目录与备用发现机制
核心原则:404 是常态。官方文档 URL 经常变化,但根目录永远不会变。
根目录(不变)
| 根目录 | 说明 |
|---|---|
https://help.aliyun.com/ |
阿里云帮助中心根目录 |
https://www.aliyun.com/ |
阿里云官网首页 |
https://help.aliyun.com/zh/model-studio/ |
百炼文档首页 |
URL 变更应对策略
当已知文档 URL 返回 404 时,按以下顺序尝试:
策略 1:访问上级目录
已知 URL: https://help.aliyun.com/zh/model-studio/qwen-tts
→ 404 时访问: https://help.aliyun.com/zh/model-studio/
→ 在页面中搜索新链接
策略 2:访问文档首页
访问: https://help.aliyun.com/zh/model-studio/
→ 这是百炼文档的入口页面,包含所有子文档的导航链接
→ 从中提取最新的各能力文档 URL
策略 3:搜索阿里云官网
访问: https://www.aliyun.com/
→ 使用站内搜索:"百炼" 或 "model-studio" 或具体功能名称
→ 或直接访问: https://www.aliyun.com/search?keywords=百炼+语音合成
策略 4:搜索帮助中心
访问: https://help.aliyun.com/
→ 使用帮助中心搜索功能
→ 或在浏览器中使用: site:help.aliyun.com {关键词}
已知有效入口页面
| 页面 | URL | 说明 |
|---|---|---|
| 百炼文档首页 | https://help.aliyun.com/zh/model-studio/ |
⭐ 最重要入口 |
| 模型列表 | https://help.aliyun.com/zh/model-studio/models |
所有模型规格 |
| 首次调用 | https://help.aliyun.com/zh/model-studio/first-api-call-to-qwen |
快速入门 |
| API Key | https://help.aliyun.com/zh/model-studio/get-api-key |
获取密钥 |
| 限流 | https://help.aliyun.com/zh/model-studio/rate-limit |
限流说明 |
| 地域选择 | https://help.aliyun.com/zh/model-studio/regions/ |
地域和服务部署范围 |
| 模型计费 | https://help.aliyun.com/zh/model-studio/model-pricing |
模型调用计费 |
| Token Plan | https://help.aliyun.com/zh/model-studio/token-plan-overview |
🆕 团队版Token Plan |
| Coding Plan | https://help.aliyun.com/zh/model-studio/coding-plan |
🆕 Coding Plan |
这些入口页面几乎不会变化,即使子文档 URL 变了,从入口页面总能找到新链接。
📁 输出目录结构
output/
├── INDEX.md ← 总索引
├── language-models/ ← 语言模型
├── video-generation/ ← 视频生成
├── image-generation/ ← 图像生成
├── tts/ ← 语音合成
├── asr/ ← 语音识别
├── embedding/ ← 向量模型
├── vision/ ← 视觉理解
├── tool-calls/ ← 工具调用
├── batch/ ← Batch 批量
├── rate-limit/ ← 限流
└── error-codes/ ← 错误码
📋 抓取流程
第 0 步:确认入口(每次必做)
# 先访问百炼文档首页,确认导航结构未变
web_fetch(url="https://help.aliyun.com/zh/model-studio/", maxChars=20000)
从首页提取当前各能力文档的最新 URL。
第 1 步:批量抓取官方文档
使用 web_fetch 抓取所有核心文档。如果某个 URL 返回 404,不要跳过,执行第 0 步从入口页面找到新 URL。
⚠️ 2026-05 起 URL 结构调整:官方将平铺 URL 改为嵌套结构,例如
text-generation→text-generation-model/。旧 URL 部分仍可访问,但建议使用新 URL。
# 核心文档(高优先级)— 🆕 使用新 URL 结构
web_fetch(url="https://help.aliyun.com/zh/model-studio/text-generation-model/", maxChars=20000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/vision-model/", maxChars=15000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/embedding-rerank-model/", maxChars=15000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/rate-limit", maxChars=15000)
# 文本生成子文档
web_fetch(url="https://help.aliyun.com/zh/model-studio/text-generation", maxChars=15000) # 概述
web_fetch(url="https://help.aliyun.com/zh/model-studio/multi-round-conversation", maxChars=15000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/stream", maxChars=15000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/deep-thinking", maxChars=15000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/qwen-structured-output", maxChars=15000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/partial-mode", maxChars=15000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/context-cache", maxChars=15000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/batch-inference", maxChars=15000)
# 视觉理解(已重组为 vision-model/ 下的多个子页面)
web_fetch(url="https://help.aliyun.com/zh/model-studio/vision-model/", maxChars=20000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/vision", maxChars=15000) # 图像与视频理解
web_fetch(url="https://help.aliyun.com/zh/model-studio/qwen-vl-ocr", maxChars=15000) # 文字提取 (OCR)
web_fetch(url="https://help.aliyun.com/zh/model-studio/visual-reasoning", maxChars=15000) # 视觉推理
# 语音合成(已重组为 tts-model/ 下的多个子页面)
web_fetch(url="https://help.aliyun.com/zh/model-studio/tts-model/", maxChars=20000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/text-to-speech", maxChars=15000) # 实时语音合成-CosyVoice
web_fetch(url="https://help.aliyun.com/zh/model-studio/qwen-tts-realtime", maxChars=15000) # 实时语音合成-千问
web_fetch(url="https://help.aliyun.com/zh/model-studio/qwen-tts", maxChars=15000) # 语音合成-千问
# 语音识别(已重组为 asr-model/ 下的多个子页面)
web_fetch(url="https://help.aliyun.com/zh/model-studio/asr-model/", maxChars=20000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/real-time-speech-recognition", maxChars=15000) # 实时语音识别
web_fetch(url="https://help.aliyun.com/zh/model-studio/qwen-real-time-speech-recognition", maxChars=15000) # 实时-千问
web_fetch(url="https://help.aliyun.com/zh/model-studio/recording-file-recognition", maxChars=15000) # 录音文件识别
web_fetch(url="https://help.aliyun.com/zh/model-studio/qwen-speech-recognition", maxChars=15000) # 录音文件-千问
# 🆕 语音转语音(新增)
web_fetch(url="https://help.aliyun.com/zh/model-studio/s2s-model/", maxChars=20000)
# 🆕 音乐生成
web_fetch(url="https://help.aliyun.com/zh/model-studio/fun-music", maxChars=15000)
# 🆕 向量与重排序子页面
web_fetch(url="https://help.aliyun.com/zh/model-studio/embedding", maxChars=15000) # 文本与多模态向量化
web_fetch(url="https://help.aliyun.com/zh/model-studio/rerank", maxChars=15000) # 重排序
# 图片生成与编辑(已重组为 image-model/ 下的多个子页面)
web_fetch(url="https://help.aliyun.com/zh/model-studio/image-model/", maxChars=20000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/text-to-image", maxChars=15000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/style-repaint", maxChars=15000) # 🆕 人像风格重绘
web_fetch(url="https://help.aliyun.com/zh/model-studio/image-background-generation", maxChars=15000) # 🆕 背景生成
web_fetch(url="https://help.aliyun.com/zh/model-studio/image-expansion", maxChars=15000) # 🆕 画面扩展
web_fetch(url="https://help.aliyun.com/zh/model-studio/virtual-model-generation", maxChars=15000) # 🆕 虚拟模特
web_fetch(url="https://help.aliyun.com/zh/model-studio/creative-poster-generation-overview", maxChars=15000) # 🆕 创意海报
web_fetch(url="https://help.aliyun.com/zh/model-studio/vary-region", maxChars=15000) # 🆕 局部重绘
web_fetch(url="https://help.aliyun.com/zh/model-studio/sketch-to-image", maxChars=15000) # 🆕 涂鸦作画
web_fetch(url="https://help.aliyun.com/zh/model-studio/shoes-and-boots-model", maxChars=15000) # 🆕 鞋靴模特
web_fetch(url="https://help.aliyun.com/zh/model-studio/image-instance-segmentation", maxChars=15000) # 🆕 人物实例分割
web_fetch(url="https://help.aliyun.com/zh/model-studio/image-erasure-and-completion", maxChars=15000) # 🆕 图像擦除补全
# 视频生成与编辑(已重组为 video-generate-edit-model/ 下的多个子页面)
web_fetch(url="https://help.aliyun.com/zh/model-studio/video-generate-edit-model/", maxChars=20000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/text-to-video-guide", maxChars=20000) # 文生视频 (Wan 2.7)
web_fetch(url="https://help.aliyun.com/zh/model-studio/wan-image-to-video-guide", maxChars=20000) # 图生视频 (Wan 2.7)
web_fetch(url="https://help.aliyun.com/zh/model-studio/image-to-video-first-and-last-frames-guide", maxChars=20000) # 首尾帧
web_fetch(url="https://help.aliyun.com/zh/model-studio/image-to-video-guide", maxChars=15000) # 🆕 图生视频-基于首帧 (NEW)
web_fetch(url="https://help.aliyun.com/zh/model-studio/video-to-video-guide", maxChars=20000) # 参考生视频 (Wan 2.7)
# ⚠️ 双导航陷阱:video-generate-edit-model/ (用户指南) 只展示 Wan 2.7 ≠ HappyHorse 已废弃
# 必须通过 API 参考侧边栏 /zh/model-studio/get-api-key 确认 HappyHorse 是否仍在
# 🆕 API 参考侧边栏新增链接(API参考页面:/zh/model-studio/get-api-key)
# 以下 URL 在 API 参考侧边栏中可找到,用于补充抓取
# 图像生成 API 参考
web_fetch(url="https://help.aliyun.com/zh/model-studio/qwen-mt-image-api", maxChars=10000) # 🆕 千问-图像翻译
web_fetch(url="https://help.aliyun.com/zh/model-studio/text-to-image-v2-api-reference", maxChars=10000) # 🆕 万相-文生图V2
web_fetch(url="https://help.aliyun.com/zh/model-studio/text-to-image-api-reference", maxChars=10000) # 🆕 万相-文生图V1
web_fetch(url="https://help.aliyun.com/zh/model-studio/outfitanyone/", maxChars=10000) # 🆕 AI试衣OutfitAnyone
web_fetch(url="https://help.aliyun.com/zh/model-studio/facechain-portrait-generation/", maxChars=10000) # 🆕 人物写真FaceChain
web_fetch(url="https://help.aliyun.com/zh/model-studio/wordart-quick-start/", maxChars=10000) # 🆕 创意文字WordArt锦书API
web_fetch(url="https://help.aliyun.com/zh/model-studio/kling-image-generation-api-reference", maxChars=10000) # 🆕 可灵-图像生成
# 视频生成 API 参考
web_fetch(url="https://help.aliyun.com/zh/model-studio/image-to-video-general-api-reference", maxChars=10000) # 🆕 万相2.7-图生视频
web_fetch(url="https://help.aliyun.com/zh/model-studio/text-to-video-api-reference", maxChars=10000) # 🆕 万相2.7-文生视频
web_fetch(url="https://help.aliyun.com/zh/model-studio/wan-video-to-video-api-reference", maxChars=10000) # 🆕 万相2.7-参考生视频
web_fetch(url="https://help.aliyun.com/zh/model-studio/wan-video-editing-api-reference", maxChars=10000) # 🆕 万相2.7-视频编辑
# 角色动画/数字人 API 参考
web_fetch(url="https://help.aliyun.com/zh/model-studio/wan-s2v-overview/", maxChars=10000) # 🆕 万相-数字人
web_fetch(url="https://help.aliyun.com/zh/model-studio/animateanyone-quick-start/", maxChars=10000) # 🆕 图生舞蹈视频-AnimateAnyone
web_fetch(url="https://help.aliyun.com/zh/model-studio/emo-quick-start/", maxChars=10000) # 🆕 图生唱演视频-EMO
web_fetch(url="https://help.aliyun.com/zh/model-studio/liveportrait-quick-start/", maxChars=10000) # 🆕 图生播报视频-LivePortrait
web_fetch(url="https://help.aliyun.com/zh/model-studio/videoretalk/", maxChars=10000) # 🆕 视频口型替换-VideoRetalk
web_fetch(url="https://help.aliyun.com/zh/model-studio/emoji-quick-start/", maxChars=10000) # 🆕 图生表情包视频-Emoji
web_fetch(url="https://help.aliyun.com/zh/model-studio/video-style-transform-api-reference", maxChars=10000) # 🆕 视频风格重绘
# 第三方视频模型 API 参考
web_fetch(url="https://help.aliyun.com/zh/model-studio/pixverse-text-to-video-api-reference", maxChars=10000) # 🆕 爱诗-文生视频
web_fetch(url="https://help.aliyun.com/zh/model-studio/pixverse-image-to-video-api-reference", maxChars=10000) # 🆕 爱诗-图生视频-基于首帧
web_fetch(url="https://help.aliyun.com/zh/model-studio/pixverse-keyframe-to-video-api-reference", maxChars=10000) # 🆕 爱诗-图生视频-基于首尾帧
web_fetch(url="https://help.aliyun.com/zh/model-studio/pixverse-reference-to-video-api-reference", maxChars=10000) # 🆕 爱诗-参考生视频
web_fetch(url="https://help.aliyun.com/zh/model-studio/kling-video-generation-api-reference/", maxChars=10000) # 🆕 可灵-视频生成
web_fetch(url="https://help.aliyun.com/zh/model-studio/vidu-text-to-video-api-reference", maxChars=10000) # 🆕 Vidu-文生视频
web_fetch(url="https://help.aliyun.com/zh/model-studio/vidu-image-to-video-api-reference", maxChars=10000) # 🆕 Vidu-图生视频-基于首帧
web_fetch(url="https://help.aliyun.com/zh/model-studio/vidu-keyframe-to-video-api-reference", maxChars=10000) # 🆕 Vidu-图生视频-基于首尾帧
web_fetch(url="https://help.aliyun.com/zh/model-studio/vidu-reference-to-video-api-reference", maxChars=10000) # 🆕 Vidu-参考生视频
# 🆕 角色动画(新增类别)
web_fetch(url="https://help.aliyun.com/zh/model-studio/wan-animate-move-api", maxChars=15000) # 🆕 动作迁移(URL变更)
web_fetch(url="https://help.aliyun.com/zh/model-studio/wan-animate-mix-api", maxChars=15000) # 🆕 视频角色替换(URL变更)
# 3D模型生成 🆕
web_fetch(url="https://help.aliyun.com/zh/model-studio/tripo-3d-generation-guide", maxChars=15000)
# 🆕 模型调优
web_fetch(url="https://help.aliyun.com/zh/model-studio/wan-image-generation-finetune-guide", maxChars=15000)
# 🆕 客户端接入文档
web_fetch(url="https://help.aliyun.com/zh/model-studio/openclaw", maxChars=10000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/hermes-agent", maxChars=10000)
web_fetch(url="https://help.aliyun.com/zh/model-studio/claude-code", maxChars=10000) # 🆕 Claude Code
web_fetch(url="https://help.aliyun.com/zh/model-studio/opencode", maxChars=10000) # 🆕 OpenCode
web_fetch(url="https://help.aliyun.com/zh/model-studio/cursor", maxChars=10000) # 🆕 Cursor
web_fetch(url="https://help.aliyun.com/zh/model-studio/codex", maxChars=10000) # 🆕 Codex
web_fetch(url="https://help.aliyun.com/zh/model-studio/qwen-code", maxChars=10000) # 🆕 Qwen Code
web_fetch(url="https://help.aliyun.com/zh/model-studio/qwenpaw", maxChars=10000) # 🆕 QwenPaw(原 CoPaw)
web_fetch(url="https://help.aliyun.com/zh/model-studio/cherry-studio", maxChars=10000) # 🆕 Cherry Studio
web_fetch(url="https://help.aliyun.com/zh/model-studio/chatbox", maxChars=10000) # 🆕 Chatbox
web_fetch(url="https://help.aliyun.com/zh/model-studio/cline", maxChars=10000) # 🆕 Cline
web_fetch(url="https://help.aliyun.com/zh/model-studio/qoder-agent", maxChars=10000) # 🆕 Qoder
web_fetch(url="https://help.aliyun.com/zh/model-studio/lingma-agent", maxChars=10000) # Qoder CN(原 Lingma)
web_fetch(url="https://help.aliyun.com/zh/model-studio/kilo-cli", maxChars=10000) # 🆕 Kilo CLI
web_fetch(url="https://help.aliyun.com/zh/model-studio/first-call-to-image-and-video-api", maxChars=10000) # 🆕 Postman
web_fetch(url="https://help.aliyun.com/zh/model-studio/dify", maxChars=10000) # 🆕 Dify
web_fetch(url="https://help.aliyun.com/zh/model-studio/more-tools", maxChars=10000) # 🆕 更多工具
# 🆕 模型列表页(重要)
web_fetch(url="https://help.aliyun.com/zh/model-studio/models", maxChars=20000) # 模型大全(最新)
第 2 步:提取关键信息
从每个页面提取:
- 模型列表 — 模型名称、特点、支持的功能
- 快速开始代码 — Python/curl 示例
- 参数表格 — 关键参数、取值范围、说明
- 注意事项 — 有效期、SDK版本要求、地域差异
- 支持的地域 — 北京/新加坡/全球
第 3 步:生成 SKILL.md
每个类别的 SKILL.md 标准结构:
# {类别名称}
> 更新时间:{日期}
> 来源:{官方URL}
---
## 概述
**Base URL:**
- 北京:`...`
- 新加坡:`...`
---
## 模型矩阵
| 模型 | 特点 | 适用场景 |
---
## 快速开始
### Python
### curl
---
## 关键参数
| 参数 | 说明 | 取值 |
---
## 支持的模型
### 北京地域 / 新加坡地域
---
## 注意事项
第 4 步:生成 _meta.json
{
"name": "{类别名}",
"version": "{日期}",
"description": "{描述}",
"last_updated": "{日期}",
"sources": ["{官方URL}"],
"files": ["SKILL.md"]
}
第 5 步:更新 INDEX.md
更新总索引,标注所有来源 URL 和状态。
⚠️ 注意事项
信息真实性
- 只写官方文档中明确提到的内容
- 不要基于已有知识推测
- 如果官方文档没有提到某个模型或功能,不要写入
404 处理
- 已知 URL 返回 404 → 访问
https://help.aliyun.com/zh/model-studio/找到新 URL - 如果入口页面也变了 → 访问
https://help.aliyun.com/搜索"百炼" - 如果搜索也失败 → 访问
https://www.aliyun.com/搜索 - 根目录 https://help.aliyun.com/ 和 https://www.aliyun.com/ 永远不会变
⚠️ 模型废弃判定 — 双导航陷阱
百炼文档有两套并行的导航结构,不能从一个推断另一个:
| 导航类型 | 入口 | 说明 |
|---|---|---|
| 用户指南(模型) | /zh/model-studio/what-is-model-studio |
侧重使用流程、教程、最佳实践 |
| API参考(模型) | /zh/model-studio/get-api-key |
侧重接口规范、参数表、代码示例 |
2026-05-08 教训:video-generate-edit-model/(用户指南)页面只展示了 Wan 2.7,但 HappyHorse 的 API 参考文档(happyhorse-text-to-video-api-reference 等 4 个页面)完全正常且当天刚更新。Guide 页面侧重某个模型 ≠ 其他模型已废弃。
正确判定流程:
- Guide 页面找不到某模型 → 不要立刻判定废弃
- 必须访问 API 参考侧边栏(
/zh/model-studio/get-api-key)确认该模型的 API 文档是否仍存在 - 必须访问模型列表页(
/zh/model-studio/models)确认该模型是否仍在列表中 - 只有 API 参考页面 + 模型列表 都确认不存在 → 才能判定废弃
备用抓取方式
备用抓取方式
当 web_fetch 返回内容不完整或被截断时,使用 browser 工具链:
browser_navigate(url) → browser_console("document.querySelector('main').innerText")
这能获取完整的页面文本内容,适合提取详细的模型参数和代码示例。
时效性
- 每个文档标注更新日期和来源 URL
- 模型列表、限流条件等数据经常变化,以官方最新为准
📊 当前文档状态(2026-08-10)
| 类别 | 文件数 | 状态 | 来源 |
|---|---|---|---|
| language-models | 8 | ✅ | text-generation-model/, deep-thinking, context-cache, stream, structured-output, partial-mode, batch-inference |
| video-generation | 22 | ✅ | video-generate-edit-model/, Wan 2.7/2.6/2.5/2.2 API, HappyHorse 1.0 全系列 |
| image-generation | 19 | ✅ | image-model/, style-repaint, background-generation, image-expansion, virtual-model, creative-poster, vary-region, sketch-to-image, shoes-and-boots, instance-segmentation, erasure-completion |
| tts | 2 | ✅ | tts-model/ |
| asr | 2 | ✅ | asr-model/ |
| s2s | 2 | ✅ | s2s-model/ (Qwen3.5-Omni, Qwen3-Omni, Livetranslate) |
| music | 2 | ✅ | fun-music |
| 3d-generation | 2 | ✅ | tripo-3d-generation-guide |
| embedding | 4 | ✅ | embedding-rerank-model/, embedding, rerank |
| vision | 4 | ✅ | vision-model/, vision, qwen-vl-ocr, visual-reasoning |
| tool-calls | 2 | ✅ | tool-calls, function-calling |
| batch | 2 | ✅ | batch-inference |
| rate-limit | 2 | ✅ | rate-limit |
| error-codes | 2 | ✅ | error-code |
| finetuning | 1 | ⚠️ 部分 | wan-video-generation-finetune-guide |
| omni | 1 | ✅ | omni/(全模态) |
总计:约 95+ 个文件
🆕 v5.4 变更(2026-08-24)
| 变更类型 | 内容 | 说明 |
|---|---|---|
| 🔄 模型列表页更新日期 | 2026-08-21 21:13:10 | 上次为 2026-08-04 |
| 🔄 文本生成页更新日期 | 2026-08-12 11:21:09 | 与上周相同 |
| 🔄 图像生成页更新日期 | 2026-08-11 11:46:00 | 与上周相同 |
| 🔄 视频生成页更新日期 | 2026-07-29 23:46:52 | 与上周相同 |
| 🔄 TTS 页更新日期 | 2026-08-07 22:07:04 | 与上周相同 |
| 🔄 向量与重排序页更新日期 | 2026-07-01 13:47:35 | 与上周相同 |
| 🆕 语言模型 | qwen3.8-max | 从 qwen3.8-max-preview 升级为正式版(1M上下文,64k输出,256k思考预算) |
| 🆕 语言模型 | ZHIPU/GLM-5.3 | 新增第三方模型(三方直供),升级自 glm-5.2 |
| 🆕 向量模型 | qwen3.7-text-embedding | 新增文本向量化模型 |
| 📝 本周总结 | 3个新模型 | qwen3.8-max 正式GA、GLM-5.3 上线、qwen3.7-text-embedding 新增 |
🆕 v5.3 变更(2026-08-17)
| 变更类型 | 内容 | 说明 |
|---|---|---|
| 🔄 文本生成页更新日期 | 2026-08-12 11:21:09 | 上次为 2026-08-03(无实质模型变更) |
| 🔄 图像生成页更新日期 | 2026-08-11 11:46:00 | 上次为 2026-08-05(无实质模型变更) |
| 🔄 视频生成页更新日期 | 2026-07-29 23:46:52 | 与上周相同 |
| 🔄 TTS 页更新日期 | 2026-08-07 22:07:04 | 与上周相同 |
| 📝 本周总结 | 无实质模型变更 | 仅页面元数据更新日期,模型列表和推荐表无变化 |
🆕 v5.2 变更(2026-08-10)
| 变更类型 | 内容 | 说明 |
|---|---|---|
| 🔄 模型列表页更新日期 | 2026-08-04 11:31:17 | 上次为 2026-07-31 |
| 🔄 文本生成页更新日期 | 2026-08-03 09:55:50 | 无实质模型变更 |
| 🔄 图像生成页更新日期 | 2026-08-05 01:05:02 | 新增 qwen-image-3.0 |
| 🔄 TTS 页更新日期 | 2026-08-07 22:07:04 | 上次为 2026-07-31(无实质变更) |
| 🆕 图像模型 | qwen-image-3.0 | 新增 qwen-image-3.0(3.0-pro 的快速版,2048×2048,文生图+编辑) |
| 🔄 图像模型 | qwen-image-3.0-pro 去邀测 | 从"邀测中"升级为正式推荐模型 |
| 🔄 文本模型 | deepseek-v4-flash → deepseek-v4-flash-0731 | 模型列表页使用版本化名称 |
| 🆕 文本模型 | Qwen3-Coder 系列 | 新增 qwen3-coder-plus/flash/next/480b-a35b-instruct/30b-a3b-instruct(1M/256k上下文,编程专用) |
| 🔄 图像推荐表 | 新增闭源迁移对照 | Nano Banana Pro/GPT Image/Seedream 4.0 → qwen-image-3.0-pro/wan2.7-image-pro |
| 🔄 图像推荐表 | 平衡档新增 | Imagen 4 Ultra/Midjourney v7 → qwen-image-3.0/wan2.7-image |
🆕 v5.1 变更(2026-08-03)
| 变更类型 | 内容 | 说明 |
|---|---|---|
| 🆕 模型列表 | kimi/kimi-k3 | 新增 kimi-k3(三方直供),覆盖理解(文本/图像/视频)场景 |
| 🆕 TTS 推荐 | qwen-audio-3.0-tts-plus | 新增 qwen-audio-3.0-tts-plus(支持 WebSocket/HTTP,声音复刻,指令控制),成为 TTS 首选推荐 |
| 🆕 TTS 推荐 | qwen-audio-3.0-tts-flash | 新增 qwen-audio-3.0-tts-flash(声音复刻,指令控制) |
| 🆕 TTS 推荐 | cosyvoice-v3.5-flash | 新增 cosyvoice-v3.5-flash(声音复刻+声音设计,指令控制) |
| 🆕 TTS 推荐 | cosyvoice-v3-flash | 新增 cosyvoice-v3-flash(声音复刻+声音设计,指令控制) |
| 🆕 TTS 推荐 | MiniMax/speech-2.8-hd | 新增 MiniMax/speech-2.8-hd 作为 TTS 推荐模型 |
| 🔄 TTS 页面重组 | TTS 页面全面重组 | 从旧版 CosyVoice/qwen-tts 结构重组为 Qwen-Audio-TTS、CosyVoice、Qwen3-TTS、MiniMax、Qwen-TTS(旧版)五大系列 |
| 🔄 TTS 页面 | 新增"从闭源模型迁移到百炼"对照表 | ElevenLabs/OpenAI/Google → 百炼模型映射 |
| 🔄 TTS 页面 | 新增"声音复刻还是声音设计?"决策指南 | 输入方式、效果、适用场景对比 |
| 🔄 TTS 页面 | 新增 WebSocket vs HTTP 决策指南 | 实时交互 vs 非实时场景选择 |
| 🔄 TTS 页面 | 新增指令控制功能说明 | 支持自然语言控制语速、情绪和风格 |
| 🔄 视频生成 | HappyHorse 1.1 新增 480P | HappyHorse 1.1 系列分辨率扩展至 480P/720P/1080P |
| 🔄 视频生成 | 推荐表新增 timestamped Wan 2.7 模型 | wan2.7-t2v-2026-06-12、wan2.7-i2v-2026-04-25、wan2.7-r2v-2026-06-12 进入推荐表 |
| 🔄 视频生成 | wan2.7-r2v 更名为 wan2.7-r2v-2026-06-12 | 推荐模型表使用版本化模型名 |
| 🔄 视频生成 | wan2.7-t2v 新增 wan2.7-t2v-2026-06-12 | 推荐模型表中新增该版本化模型 |
| 🔄 模型列表页更新日期 | 2026-07-31 14:55:55 | 上次为 2026-07-27 |
| 🔄 文本生成页更新日期 | 2026-07-25 13:28:38 | 上次为 2026-07-27(无实质变更) |
| 🔄 图像生成页更新日期 | 2026-07-21 11:27:43 | 无实质变更 |
| 🔄 视频生成页更新日期 | 2026-07-29 23:46:52 | 上次为 2026-07-27 |
| 🔄 TTS 页更新日期 | 2026-07-31 17:42:18 | 重大更新 |
🆕 v5.0 变更(2026-07-27)
| 变更类型 | 内容 | 说明 |
|---|---|---|
| 🆕 语言模型 | qwen3.8-max-preview | 新旗舰模型,仅 Token Plan 可用,对标 GPT-5.5/Claude Opus 4.7/Gemini 3.1 Pro |
| 🆕 语言模型 | qwen3.7-plus | 新增推荐模型(1M上下文),能力与成本均衡,完整工具调用支持,适合编程/Agent开发 |
| 🆕 语言模型 | qwen3.7-flash | 新增快速版(1M上下文),效果接近旗舰但成本更低 |
| 🆕 语言模型 | qwen-long | 超长上下文模型(1000万Token),适合大体量文档处理 |
| 🆕 语言模型 | glm-5.2 | 第三方模型升级至 5.2(1M上下文),替代 glm-5.1 |
| 🆕 语言模型 | MiniMax-M3 | 新增 MiniMax-M3(192k上下文),替代 MiniMax-M2.7 |
| 🆕 语言模型 | kimi-k2.7-code | 新增 kimi-k2.7-code(256k上下文) |
| 🆕 语言模型 | deepseek-v4-flash | 新增 deepseek-v4-flash(1M上下文,快速版) |
| 🔄 图像模型 | qwen-image-3.0-pro | 新增 qwen-image-3.0-pro(邀测中),支持复杂版面生成、小字渲染、多语言字体 |
| 🔄 图像模型 | qwen-image-2.0-pro-2026-06-22 | 新增版本化快照 |
| 🔄 图像模型 | qwen-image-max/plus | 去除版本号后缀,变为 qwen-image-max / qwen-image-plus |
| 🔄 视频模型 | happyhorse-1.1-t2v/i2v/r2v | HappyHorse 从 1.0 升级至 1.1 系列(t2v/i2v/r2v) |
| 🔄 视频模型 | qwen-image-3.0-pro | 图像生成页面推荐模型表新增 |
🆕 v4.9 变更(2026-06-15)
| 变更类型 | 内容 | 说明 |
|---|---|---|
| 🆕 客户端工具 | QwenPaw(原 CoPaw) | 新增 AgentScope 团队开源的 AI 助手接入文档,支持 Token Plan/Coding Plan/按量计费 |
| 🔄 URL 变更 | wan-video-generation-finetune-guide → wan-image-generation-finetune-guide | 图像生成模型调优页面 URL 变更 |
| 🆕 语言模型 | qwen3.7-max-2026-06-08 | 新增 qwen3.7-max 版本化模型(1M上下文,64k输出,256k思考预算) |
🆕 v4.8 变更(2026-06-08)
| 变更类型 | 内容 | 说明 |
|---|---|---|
| 🆕 视频生成子页面 | image-to-video-guide | 新增"图生视频-基于首帧"独立子页面(Wan 2.6/2.5/2.2 i2v 系列) |
| 🔄 URL 变更 | wan-animate-move → wan-animate-move-api | 角色动画 API 参考 URL 变更 |
| 🔄 URL 变更 | wan-animate-mix → wan-animate-mix-api | 角色替换 API 参考 URL 变更 |
| 🆕 API 参考 | 千问-图像翻译 | 新增 qwen-mt-image-api |
| 🆕 API 参考 | 万相-文生图V1/V2 | 新增 text-to-image-v2-api-reference, text-to-image-api-reference |
| 🆕 API 参考 | AI试衣/人物写真/创意文字 | 新增 outfitanyone, facechain-portrait-generation, wordart-quick-start |
| 🆕 API 参考 | 可灵-图像生成 | 新增 kling-image-generation-api-reference |
| 🆕 API 参考 | 万相2.7 系列 API | 新增 image-to-video-general, text-to-video, wan-video-to-video, wan-video-editing |
| 🆕 API 参考 | 万相-数字人 | 新增 wan-s2v-overview |
| 🆕 API 参考 | 数字人系列 | 新增 AnimateAnyone, EMO, LivePortrait, VideoRetalk, Emoji, 视频风格重绘 |
| 🆕 API 参考 | 爱诗(PixVerse) | 新增 t2v, i2v(首帧), i2v(首尾帧), r2v 四个 API 参考 |
| 🆕 API 参考 | 可灵-视频生成 | 新增 kling-video-generation-api-reference |
| 🆕 API 参考 | Vidu | 新增 t2v, i2v(首帧), i2v(首尾帧), r2v 四个 API 参考 |
🆕 v4.7 变更(2026-06-01)
| 变更类型 | 内容 | 说明 |
|---|---|---|
| 🔄 第三方模型 | MiniMax-M2.5 → MiniMax-M2.7 | 官方模型列表页已将 MiniMax-M2.5 更名为 MiniMax-M2.7(文本生成详情页仍显示 M2.5 参数,待官方同步) |
🆕 v4.6 变更(2026-05-25)
| 变更类型 | 内容 | 说明 |
|---|---|---|
| 🆕 语言模型 | qwen3.7-max / qwen3.7-max-2026-05-20 | 新旗舰模型,1M上下文,256k思考预算 |
| 🆕 第三方模型 | mimo-v2.5-pro | 新第三方模型,1M上下文 |
| 🔄 客户端重命名 | Lingma → Qoder CN | 官方将 Lingma 更名为 Qoder CN(原 Lingma) |
| 🆕 客户端文档 | 更多工具 (more-tools) | 新增 OpenAI/Anthropic 兼容端点配置文档 |
| 🆕 图像模型 | qwen-image-edit-max/plus/edit | 新增千问图像编辑模型系列 |
| 🆕 图像模型 | qwen-image-* 版本化模型 | qwen-image-2.0-pro-2026-03-03 等版本化模型 |
🆕 v4.5 变更(2026-05-18)
| 变更类型 | 内容 | 说明 |
|---|---|---|
| 🆕 客户端工具 | Claude Code | Claude Code 接入文档 |
| 🆕 客户端工具 | OpenCode | OpenCode 接入文档 |
| 🆕 客户端工具 | Cursor | Cursor 接入文档 |
| 🆕 客户端工具 | Codex | Codex 接入文档 |
| 🆕 客户端工具 | Qwen Code | Qwen Code 接入文档 |
| 🆕 客户端工具 | Cherry Studio | Cherry Studio 接入文档 |
| 🆕 客户端工具 | Chatbox | Chatbox 接入文档 |
| 🆕 客户端工具 | Cline | Cline 接入文档 |
| 🆕 客户端工具 | Qoder | Qoder Agent 接入文档 |
| 🆕 客户端工具 | Postman | Postman 图文视频 API 首次调用 |
| 🆕 客户端工具 | Dify | Dify 接入文档 |
| 🆕 图像模型 | z-image-turbo | 新增快速版 Z-Image 模型 |
| 🆕 图像模型 | wan2.6-t2i/image | Wan 2.6 图像生成模型 |
| 🆕 图像模型 | wan2.5-t2i/i2i-preview | Wan 2.5 图像预览模型 |
| 🆕 图像模型 | wan2.2/2.1-t2i | Wan 2.2/2.1 图像模型(旧版) |
| 🆕 导航 | 全模态 | omni/ 新入口页面 |
🆕 v4.4 变更(2026-05-12)
| 变更类型 | 内容 | 说明 |
|---|---|---|
| 🆕 视频生成 Wan 2.6 | wan2.6-t2v/i2v/r2v 系列 | 完整 Wan 2.6 系列(含 flash 加速版、美国地域版) |
| 🆕 视频生成 Wan 2.5 | wan2.5-t2v-preview/i2v-preview | Wan 2.5 Preview 版,支持 480P/720P/1080P |
| 🆕 角色动画 | wan2.2-animate-move/mix | 动作迁移到静态人物、视频中替换人物 |
| 🆕 视频编辑 | wan2.7-videoedit | 特效复刻、运镜复刻 |
| 🆕 图像编辑 | shoes-and-boots-model | 鞋靴模特生成 |
| 🆕 图像编辑 | image-instance-segmentation | 人物实例分割 |
| 🆕 图像编辑 | image-erasure-and-completion | 图像擦除补全 |
| 🆕 客户端 | kilo-cli | Kilo CLI 接入文档 |
🆕 v4.1 变更(2026-05-08)
| 变更类型 | 内容 | 说明 |
|---|---|---|
| URL 重组 | 文本生成/视觉理解/语音/图片/视频 | 平铺 URL → 嵌套结构(*-model/) |
| 🆕 音乐生成 | fun-music | Fun 音乐大模型 |
| 🆕 语音转语音 | s2s-model/ | 全模态 + 语音翻译 |
| 🆕 3D 模型生成 | tripo-3d-generation-guide | Tripo 3D 生成 |
| 🆕 图片编辑 | style-repaint 等 8 个子页面 | 人像风格重绘、背景生成、画面扩展等 |
| 🆕 视频子页面 | text-to-video-guide 等 | 文生视频、图生视频、首尾帧 |
| 🆕 Token Plan | token-plan-overview | 团队版 Token Plan |
| 🆕 Coding Plan | coding-plan | Coding Plan |
| 🆕 Lingma | lingma-agent | 新客户端接入 |
| 🆕 Qwen3.6 系列 | text-generation-model/ | qwen3.6-max-preview, qwen3.6-plus(1M), qwen3.6-flash(1M) |
| 🆕 第三方模型 | text-generation-model/ | deepseek-v4-pro/flash(1M), glm-5.1, kimi-k2.6, MiniMax-M2.5 |
| 🆕 Qwen3.5 系列 | text-generation-model/ | qwen3.5-plus(1M), qwen3.5-flash(1M), 397b/122b/27b/35b MoE |
| 🆕 视觉理解升级 | vision-model/ | Qwen3.6-plus/flash: 1M上下文, 16M像素, 2小时视频 |
| 🆕 TTS CosyVoice v3.5 | tts-model/ | 声音复刻+声音设计+指令控制 |
| 🆕 ASR Qwen3-ASR | asr-model/ | 情感识别, 多语种 |
| 🆕 S2S Qwen3.5-Omni | s2s-model/ | Function Calling + 联网搜索, 29种语言翻译 |
| 🆕 Embedding v4 | embedding-rerank-model/ | text-embedding-v4: 64~2048维 |
| 🆕 多模态 Embedding | embedding-rerank-model/ | qwen3-vl-embedding, tongyi-embedding-vision-plus |
| 🆕 Rerank | embedding-rerank-model/ | qwen3-rerank(文本), qwen3-vl-rerank(多模态) |
🆕 v4.0 新增文档(2026-04-28)
| 新文档 | URL | 说明 |
|---|---|---|
| HappyHorse-文生视频 | happyhorse-text-to-video-api-reference | happyhorse-1.0-t2v |
| HappyHorse-图生视频 | happyhorse-image-to-video-api-reference | happyhorse-1.0-i2v |
| HappyHorse-参考生视频 | happyhorse-reference-to-video-api-reference | happyhorse-1.0-r2v |
| HappyHorse-视频编辑 | happyhorse-video-edit-api-reference | happyhorse-1.0-video-edit |
| 万相-图像生成与编辑2.7 | wan-image-generation-and-editing-api-reference | wan2.7-image-pro/image |
| 千问-文生图 | qwen-image-api | qwen-image-2.0-pro/2.0/max/plus |
| 千问-图像编辑 | qwen-image-edit-api | 独立编辑接口 |
| Z-Image 文生图 | z-image-api-reference | 轻量快速模型 |
🔧 实战经验(从实际更新中积累)
2026-08-10 周更发现
- 模型列表页更新至 2026-08-04:deepseek-v4-flash 在模型列表页变为 deepseek-v4-flash-0731(版本化名称),但文本生成详情页仍显示 deepseek-v4-flash。
- 图像生成页更新至 2026-08-05:新增 qwen-image-3.0 模型(3.0-pro 的快速版,2048×2048,文生图+编辑均支持)。qwen-image-3.0-pro 从"邀测中"升级为正式推荐。
- 图像推荐表新增闭源迁移对照:高质量档(Nano Banana Pro、GPT Image、Seedream 4.0 → qwen-image-3.0-pro、wan2.7-image-pro);平衡档(Imagen 4 Ultra、Midjourney v7 → qwen-image-3.0、wan2.7-image);快速档(FLUX.2 → z-image-turbo)。
- 文本生成页新增 Qwen3-Coder 系列:qwen3-coder-plus(1M上下文)、qwen3-coder-flash(1M上下文)、qwen3-coder-next(256k)、qwen3-coder-480b-a35b-instruct(256k)、qwen3-coder-30b-a3b-instruct(256k)。编程专用模型,支持思考模式和 Function Calling。
- TTS 页更新至 2026-08-07:无实质模型变更,页面内容微调。
- 视频生成页导航结构不变:文生视频、图生视频、图生视频-基于首尾帧、图生视频-基于首帧、参考生视频、视频编辑六个子页面。
2026-08-03 周更发现
- TTS 页面重大重组(2026-07-31 更新):TTS 页面从旧版 CosyVoice/qwen-tts 结构全面重组为五大系列:Qwen-Audio-TTS、CosyVoice、Qwen3-TTS、MiniMax、Qwen-TTS(旧版)。新增"从闭源模型迁移到百炼"对照表(ElevenLabs/OpenAI/Google → 百炼)、"声音复刻还是声音设计?"决策指南、WebSocket vs HTTP 决策指南、指令控制功能说明。
- qwen-audio-3.0-tts-plus 成为 TTS 首选:支持 WebSocket/HTTP,声音复刻,指令控制。新增 qwen-audio-3.0-tts-flash(支持声音复刻+指令控制)。
- cosyvoice-v3.5-flash / cosyvoice-v3-flash 新增:均支持声音复刻+声音设计+指令控制。cosyvoice-v3-plus 仍不支持指令控制。
- MiniMax/speech-2.8-hd 新增为 TTS 推荐:HTTP API,支持声音复刻。
- HappyHorse 1.1 分辨率扩展至 480P:t2v/i2v/r2v 均支持 480P/720P/1080P(之前只记录 720P/1080P)。
- 视频推荐表新增 timestamped Wan 2.7 模型:wan2.7-t2v-2026-06-12(自定义音频)、wan2.7-i2v-2026-04-25(首帧/首尾帧/续写)、wan2.7-r2v-2026-06-12(参考图像和视频生视频)进入推荐表。
- kimi-k3 新增到模型列表页:三方直供,覆盖理解(文本/图像/视频)场景。
- 各页面更新日期:模型列表 2026-07-31、TTS 2026-07-31、视频生成 2026-07-29、图像生成 2026-07-21、文本生成 2026-07-25。
2026-07-27 周更发现
- qwen3.8-max-preview 新增:最新旗舰模型,仅 Token Plan 可用,对标 GPT-5.5/Claude Opus 4.7/Gemini 3.1 Pro(高能力档)。
- qwen3.7-plus / qwen3.7-flash 成为推荐主力:文本生成页面推荐模型表中,qwen3.7-plus(1M上下文)和 qwen3.7-flash(1M上下文)成为编程/Agent开发首选推荐,qwen3.7-max 仍为最强推理能力选项。
- qwen-long 新增:超长上下文模型(1000万Token/约10本小说),适合大体量文档处理场景。
- 第三方模型升级:glm-5.2 替代 glm-5.1(1M上下文);MiniMax-M3(192k上下文)替代 MiniMax-M2.7;kimi-k2.7-code(256k上下文);deepseek-v4-flash(1M上下文)新增。
- qwen-image-3.0-pro 新增(邀测中):支持复杂版面生成、小字渲染、多语言字体,文生图和编辑均支持,最大 2048×2048。
- qwen-image-2.0-pro-2026-06-22 新增:版本化快照模型。
- qwen-image-max / qwen-image-plus 去版本号:从 qwen-image-max-2025-12-30 变为 qwen-image-max,从 qwen-image-plus-2026-01-09 变为 qwen-image-plus。
- HappyHorse 1.1 系列:模型列表中 happyhorse-1.1-t2v、happyhorse-1.1-i2v、happyhorse-1.1-r2v 出现,happyhorse-1.0-video-edit 保持。HappyHorse 从 1.0 升级至 1.1。
- wan2.7-image-pro 文生图最高 4K:从 4096×4096 升级(之前记录为 4K)。
- kimi-k3 新增:模型列表页出现 kimi/kimi-k3,覆盖理解(文本/图像/视频)场景。
2026-06-15 周更发现
- QwenPaw 新增:/zh/model-studio/qwenpaw 新增客户端接入文档(更新于 2026-06-11),QwenPaw(原 CoPaw)是 AgentScope 团队开源的个人 AI 助手,支持本地或云端部署,可通过 Token Plan 团队版、Coding Plan 或按量计费接入百炼。
- 图像生成模型调优 URL 变更:导航中"图像生成模型调优"的 URL 从
wan-video-generation-finetune-guide变更为wan-image-generation-finetune-guide。 - qwen3.7-max-2026-06-08 新增:文本生成页面(2026-06-12 更新)新增 qwen3.7-max-2026-06-08 版本化模型。
- 文本生成页推荐模型表新增 qwen3.7-max:对标 GPT-5.5、Claude Opus 4.7、Gemini 3.1 Pro(高能力档)。
2026-06-08 周更发现
- 图生视频-基于首帧独立页面:video-generate-edit-model/ 导航新增独立子页面
image-to-video-guide(图生视频-基于首帧),专门介绍 Wan 2.6/2.5/2.2 i2v 系列模型的基于首帧生成能力,包括多镜头叙事、声画同步、无声视频等核心功能。 - 角色动画 API URL 变更:
wan-animate-move→wan-animate-move-api,wan-animate-mix→wan-animate-mix-api,页面标题也变为"万相-图生动作"和"万相-视频换人"。 - API 参考侧边栏大幅扩展:新增大量 API 参考链接,涵盖千问-图像翻译、万相文生图V1/V2、AI试衣OutfitAnyone、人物写真FaceChain、创意文字WordArt、可灵-图像生成、万相2.7系列API(图生视频/文生视频/参考生视频/视频编辑)、万相-数字人、AnimateAnyone/EMO/LivePortrait/VideoRetalk/Emoji等数字人系列、爱诗(PixVerse)全系列、可灵-视频生成、Vidu全系列。
- HappyHorse-图生视频 API 参考页面重命名:侧边栏标题从"HappyHorse-图生视频"变为"HappyHorse-图生视频-基于首帧"(URL不变)。
- 文本生成页面更新:text-generation-model/ 页面更新日期变更为 2026-06-04 19:32:47,新增 qwen3.7-max-preview 模型(1M上下文,64k最大输出,256k思考预算)。
2026-06-01 周更发现
- MiniMax-M2.7 更名:官方模型列表页(/zh/model-studio/models)将 "MiniMax-M2.5" 更名为 "MiniMax-M2.7",但文本生成详情页(/zh/model-studio/text-generation-model/)仍显示 MiniMax-M2.5 的参数(192k上下文、共32k最大输出)。两个页面尚未同步,可能是新版本即将上线。
- 模型列表页更新日期:2026-05-21 19:37:25。文本生成页更新日期:2026-05-25 18:23:43。
- 视频生成页新增"首尾帧生视频,构建长视频"说明:video-generate-edit-model/ 页面新增首尾帧串联构建长视频的推荐说明,推荐使用 wan2.7-i2v-2026-04-25。
- qwen3.7-max 基准对标确认:官方文本生成页确认 qwen3.7-max 对标 GPT-5.5、Claude Opus 4.7、Gemini 3.1 Pro。
2026-05-25 周更发现
- Qwen3.7-max 发布:全新旗舰模型,1M 上下文窗口,64k 最大输出,256k 思考预算,支持 Function Calling、内置工具、结构化输出、批量调用。官方文档将 qwen3.7-max 对标 GPT-5.5、Claude Opus 4.7、Gemini 3.1 Pro。
- mimo-v2.5-pro 新增:第三方模型,1M 上下文,128K 最大输出,128K 思考预算,支持 Function Calling 和内置工具。
- Lingma 更名为 Qoder CN:官方客户端列表中将 "Lingma" 更名为 "Qoder CN(原 Lingma)",URL 不变(/zh/model-studio/lingma-agent)。
- 更多工具页面新增:/zh/model-studio/more-tools 新增,记录 Token Plan/Coding Plan/按量计费三种方式的 OpenAI/Anthropic 兼容端点配置。
- 千问图像编辑模型扩展:image-model/ 页面新增 qwen-image-edit-max、qwen-image-edit-plus、qwen-image-edit 及对应版本化模型。
- 千问图像版本化模型:qwen-image-2.0-pro-2026-03-03、qwen-image-2.0-2026-03-03、qwen-image-max-2025-12-30、qwen-image-plus-2026-01-09、qwen-image(基础版)等。
- qwen3.6-max-preview 出现:256k 上下文,64k 最大输出,128k 思考预算。
- deepseek-v4-pro/flash 新增:第三方模型,1M 上下文,384k 最大输出(共),支持思考模式。
2026-05-12 周更发现
- Wan 2.6 完整系列上线:wan2.6-t2v、wan2.6-i2v、wan2.6-i2v-flash(快速版)、wan2.6-r2v、wan2.6-r2v-flash,以及美国地域版 wan2.6-t2v-us、wan2.6-i2v-us。全部支持音频同步和多镜头叙事。
- Wan 2.5 Preview:wan2.5-t2v-preview 和 wan2.5-i2v-preview,支持 480P/720P/1080P,5秒/10秒时长。
- 角色动画新类别:wan2.2-animate-move(动作迁移到静态人物,720P,2-30秒)、wan2.2-animate-mix(视频中替换人物),支持 wan-std(快速低成本)和 wan-pro(接近真实拍摄)两种模式。
- Wan 2.7 视频编辑:wan2.7-videoedit 支持特效复刻和运镜复刻,最长10秒。
- 图像编辑新增 3 个子页面:shoes-and-boots-model(鞋靴模特)、image-instance-segmentation(人物实例分割)、image-erasure-and-completion(图像擦除补全)。
- 客户端工具新增 Kilo CLI:在接入客户端列表中增加了 kilo-cli。
- Wan 2.1 标记为"推荐使用Wan 2.7":官方开始引导迁移。
- 模型列表扩展:视频生成页面现在包含 HappyHorse 1.0 → Wan 2.7 → Wan 2.6 → Wan 2.5 → Wan 2.2 → Wan 2.1 六个世代。
2026-05-08 全面更新发现
- 双导航陷阱(重要教训):
video-generate-edit-model/(用户指南)只展示 Wan 2.7,但 HappyHorse 的 API 参考文档(4 个页面)全部正常且当天更新。Guide 页面侧重某模型 ≠ 其他模型已废弃。必须通过 API 参考侧边栏和模型列表双重确认。 - browser_console 提取完整内容:
web_fetch对阿里云文档经常返回不完整内容。使用browser_navigate+browser_console("document.querySelector('main').innerText")可获取完整页面文本,适合提取详细的模型参数表和代码示例。 - Wan 2.7 新增能力:有声视频(自动配音/自定义音频)、多镜头叙事、视频续写、音色定制、多宫格图。这些在旧 skill 中完全缺失。
- SDK 版本要求提升:从 1.25.15 → 1.25.16,旧版本会报 "url error"。
- Qwen3.6 已发布:最新旗舰系列,qwen3.6-plus 和 qwen3.6-flash 支持 1M 上下文窗口。
- 第三方模型 API 格式统一:deepseek-v4-pro/flash、glm-5.1、kimi-k2.6、MiniMax-M2.5 的 API 格式与千问模型一致。
- Qwen3.5-Omni 全模态:支持文本、音频、图片、视频输入,S2S 场景推荐,支持 Function Calling + 联网搜索 + 29 种语言翻译。
- TTS 三大系列:CosyVoice(声音复刻+声音设计+指令控制)、Qwen3-TTS、MiniMax speech。
- ASR 两大路线:Fun-ASR(热词增强)和 Qwen3-ASR(情感识别),Qwen3.5-Omni 支持 Prompt 上下文注入。
- Embedding v4:text-embedding-v4 支持 64~2048 维可调,qwen3-vl-embedding 支持多模态融合向量。
- Rerank 新增:qwen3-rerank(文本,100+ 语言)、qwen3-vl-rerank(多模态,支持文本/图片/视频混合排序)。
周更任务最佳实践
- 先访问文档首页确认导航结构
- 逐个抓取子页面,404 的标记为废弃
- 对比本地 skill 的模型列表,识别新增/废弃
- 更新时用
patch而非全量重写,保留历史上下文 - 推送前检查 git diff 确认变更范围