|
9 | 9 | {"slug":"animate-anyone-gen2","name":"舞动人像AnimateAnyone","description":"AnimateAnyone是一款视频生成模型,可基于人物图片和动作模板生成人物全身动作视频。","primaryCapability":"VG","capabilities":["VG"],"providers":["qwen"],"itemCount":1,"items":[{"model":"animate-anyone-gen2","name":"舞动人像AnimateAnyone","capabilities":["VG"]}],"detailPath":"groups/animate-anyone-gen2.json"} |
10 | 10 | {"slug":"animate-anyone-template-gen2","name":"舞动人像AnimateAnyone-template","description":"AnimateAnyone-Template是辅助AnimateAnyone的动作模板生成模型,可基于视频提取人物动作并制作模板。","primaryCapability":"VG","capabilities":["VG"],"providers":["qwen"],"itemCount":1,"items":[{"model":"animate-anyone-template-gen2","name":"舞动人像AnimateAnyone-template","capabilities":["VG"]}],"detailPath":"groups/animate-anyone-template-gen2.json"} |
11 | 11 | {"slug":"cosyvoice","name":"CosyVoice大模型","description":"基于新一代生成式语音大模型,CosyVoice将文本理解和语音生成技术深度融合,能够精准解析并诠释各种文本内容,将其转化为如同真人发声般的自然语音,带来高度拟人化的自然语音合成体验。","primaryCapability":"TTS","capabilities":["TTS"],"providers":["qwen","qwen-domain-model"],"itemCount":7,"items":[{"model":"cosyvoice-clone-v1","name":"声音复刻CosyVoice大模型","capabilities":["TTS"]},{"model":"cosyvoice-v1","name":"语音合成CosyVoice大模型","capabilities":["TTS"]},{"model":"cosyvoice-v2","name":"语音生成cosyvoice-v2大模型","capabilities":["TTS"]},{"model":"cosyvoice-v3-flash","name":"语音生成CosyVoice-v3-flash大模型","capabilities":["TTS"]},{"model":"cosyvoice-v3-plus","name":"语音生成CosyVoice-v3-plus大模型","capabilities":["TTS"]},{"model":"cosyvoice-v3.5-flash","name":"语音生成CosyVoice-v3.5-flash大模型","capabilities":["TTS"]},{"model":"cosyvoice-v3.5-plus","name":"语音生成CosyVoice-v3.5-plus大模型","capabilities":["TTS"]}],"detailPath":"groups/cosyvoice.json"} |
12 | | -{"slug":"deepseek","name":"DeepSeek","description":"DeepSeek是由深度求索提供的开源模型,包含 V3.1、V3、R1以及基于Qwen2.5系列蒸馏的大语言模型。","primaryCapability":"Reasoning","capabilities":["Reasoning","TG"],"providers":["deepseek"],"itemCount":13,"items":[{"model":"deepseek-r1","name":"DeepSeek-R1","contextWindow":131072,"capabilities":["Reasoning"]},{"model":"deepseek-r1-0528","name":"DeepSeek-R1-0528","contextWindow":131072,"capabilities":["Reasoning"]},{"model":"deepseek-r1-distill-qwen-1.5b","name":"DeepSeek-R1-Distill-Qwen-1.5B","contextWindow":32768,"capabilities":["TG"]},{"model":"deepseek-r1-distill-qwen-14b","name":"DeepSeek-R1-Distill-Qwen-14B","contextWindow":32768,"capabilities":["TG"]},{"model":"deepseek-r1-distill-qwen-32b","name":"DeepSeek-R1-Distill-Qwen-32B","contextWindow":32768,"capabilities":["TG"]},{"model":"deepseek-r1-distill-qwen-7b","name":"DeepSeek-R1-Distill-Qwen-7B","contextWindow":32768,"capabilities":["TG"]},{"model":"deepseek-v3","name":"DeepSeek-V3","contextWindow":65536,"capabilities":["TG","Reasoning"]},{"model":"deepseek-v3.1","name":"DeepSeek-V3.1","contextWindow":131072,"capabilities":["TG","Reasoning"]},{"model":"deepseek-v3.2","name":"DeepSeek-V3.2","contextWindow":131072,"capabilities":["Reasoning","TG"]},{"model":"deepseek-v3.2-exp","name":"Deepseek-V3.2-Exp","contextWindow":131072,"capabilities":["TG","Reasoning"]},{"model":"deepseek-v4-flash","name":"DeepSeek-V4-Flash","contextWindow":1000000,"capabilities":["TG","Reasoning"]},{"model":"deepseek-v4-flash-0731","name":"DeepSeek-V4-Flash-0731","contextWindow":1000000,"capabilities":["Reasoning","TG"]},{"model":"deepseek-v4-pro","name":"DeepSeek-V4-Pro","contextWindow":1000000,"capabilities":["Reasoning","TG"]}],"detailPath":"groups/deepseek.json","maxContextWindow":1000000} |
| 12 | +{"slug":"deepseek","name":"DeepSeek","description":"DeepSeek是由深度求索提供的开源模型,包含 V3.1、V3、R1以及基于Qwen2.5系列蒸馏的大语言模型。","primaryCapability":"TG","capabilities":["TG","Reasoning"],"providers":["deepseek"],"itemCount":14,"items":[{"model":"deepseek-r1","name":"DeepSeek-R1","contextWindow":131072,"capabilities":["Reasoning"]},{"model":"deepseek-r1-0528","name":"DeepSeek-R1-0528","contextWindow":131072,"capabilities":["Reasoning"]},{"model":"deepseek-r1-distill-qwen-1.5b","name":"DeepSeek-R1-Distill-Qwen-1.5B","contextWindow":32768,"capabilities":["TG"]},{"model":"deepseek-r1-distill-qwen-14b","name":"DeepSeek-R1-Distill-Qwen-14B","contextWindow":32768,"capabilities":["TG"]},{"model":"deepseek-r1-distill-qwen-32b","name":"DeepSeek-R1-Distill-Qwen-32B","contextWindow":32768,"capabilities":["TG"]},{"model":"deepseek-r1-distill-qwen-7b","name":"DeepSeek-R1-Distill-Qwen-7B","contextWindow":32768,"capabilities":["TG"]},{"model":"deepseek-v3","name":"DeepSeek-V3","contextWindow":65536,"capabilities":["TG","Reasoning"]},{"model":"deepseek-v3.1","name":"DeepSeek-V3.1","contextWindow":131072,"capabilities":["TG","Reasoning"]},{"model":"deepseek-v3.2","name":"DeepSeek-V3.2","contextWindow":131072,"capabilities":["Reasoning","TG"]},{"model":"deepseek-v3.2-exp","name":"Deepseek-V3.2-Exp","contextWindow":131072,"capabilities":["TG","Reasoning"]},{"model":"deepseek-v4-flash","name":"DeepSeek-V4-Flash","contextWindow":1000000,"capabilities":["TG","Reasoning"]},{"model":"deepseek-v4-flash-0731","name":"DeepSeek-V4-Flash-0731","contextWindow":1000000,"capabilities":["Reasoning","TG"]},{"model":"deepseek-v4-pro","name":"DeepSeek-V4-Pro","contextWindow":1000000,"capabilities":["Reasoning","TG"]},{"model":"deepseek-v4-pro-0813","name":"DeepSeek-V4-Pro-0813","contextWindow":1000000,"capabilities":["TG","Reasoning"]}],"detailPath":"groups/deepseek.json","maxContextWindow":1000000} |
13 | 13 | {"slug":"embedding","name":"通义多模态向量","description":"基于LLM底座的通用多模态表征模型,支持文本、图像、视频3种模态,具有以视觉为中心、全场景性能优异、高性价比的特点,适用于以图搜图、以文搜图、以文搜视频、以视频搜视频、以文搜文等下游多样化任务场景。","primaryCapability":"ME","capabilities":["ME"],"providers":["qwen-domain-model"],"itemCount":3,"items":[{"model":"multimodal-embedding-v1","name":"通用多模态向量","contextWindow":0,"capabilities":["ME"]},{"model":"tongyi-embedding-vision-flash","name":"视觉向量-flash","capabilities":["ME"]},{"model":"tongyi-embedding-vision-plus","name":"视觉向量-plus","capabilities":["ME"]}],"detailPath":"groups/embedding.json"} |
14 | 14 | {"slug":"emo-detect-v1","name":"悦动人像EMO-detect","description":"EMO-Detect是辅助EMO的图像检测模型,用于检测图片中的人物形象是否符合视频生成要求。","primaryCapability":"VG","capabilities":["VG"],"providers":["qwen"],"itemCount":1,"items":[{"model":"emo-detect-v1","name":"悦动人像EMO-detect","capabilities":["VG"]}],"detailPath":"groups/emo-detect-v1.json"} |
15 | 15 | {"slug":"emo-v1","name":"悦动人像EMO","description":"EMO是一款视频生成模型,可基于人物图片生成高质量的人物肖像动态视频。","primaryCapability":"VG","capabilities":["VG"],"providers":["qwen"],"itemCount":1,"items":[{"model":"emo-v1","name":"悦动人像EMO","capabilities":["VG"]}],"detailPath":"groups/emo-v1.json"} |
|
59 | 59 | {"slug":"qwen-audio-asr-flash","name":"Qwen-Audio-ASR-Flash","description":"Qwen-Audio-ASR-Flash是一款支持短语音高效识别的大模型,面向高质量、多语种及文化内容转写场景。模型支持多语种与多地区中文方言识别,同时针对中文古诗词的韵律、节奏与文言表达进行优化。具备上下文增强、标点预测与文本规范化能力。","primaryCapability":"ASR","capabilities":["ASR"],"providers":["qwen"],"itemCount":1,"items":[{"model":"qwen-audio-3.0-asr-flash","name":"Qwen-Audio-3.0-ASR-Flash","capabilities":["ASR"]}],"detailPath":"groups/qwen-audio-asr-flash.json"} |
60 | 60 | {"slug":"qwen-audio-realtime-flash","name":"Qwen-Audio-Realtime-Flash","description":"Qwen-Audio-Realtime 是一款登顶全球权威评测的下一代实时双工语音大模型,模型兼顾了模型智商与双工对话节奏,在保持流畅、自然的实时交互体验的同时,语音推理能力不打折扣;并通过并行推理和全向流式等工程优化,将端到端响应时延控制在低水平,实现\"又快又聪明\"的对话体验。Flash版更注重极致的响应速度","primaryCapability":"Realtime-Chatting","capabilities":["Realtime-Chatting"],"providers":["qwen"],"itemCount":1,"items":[{"model":"qwen-audio-3.0-realtime-flash","name":"千问实时语音对话大模型3.0(极速版)","contextWindow":40960,"capabilities":["Realtime-Chatting"]}],"detailPath":"groups/qwen-audio-realtime-flash.json","maxContextWindow":40960} |
61 | 61 | {"slug":"qwen-audio-realtime-plus","name":"Qwen-Audio-Realtime-Plus","description":"Qwen-Audio-Realtime 是一款登顶全球权威评测的下一代实时双工语音大模型,模型兼顾了模型智商与双工对话节奏,在保持流畅、自然的实时交互体验的同时,语音推理能力不打折扣;并通过并行推理和全向流式等工程优化,将端到端响应时延控制在低水平,实现\"又快又聪明\"的对话体验。Plus版本更注重高质量的回复结果。","primaryCapability":"Realtime-Chatting","capabilities":["Realtime-Chatting"],"providers":["qwen"],"itemCount":1,"items":[{"model":"qwen-audio-3.0-realtime-plus","name":"千问实时语音大模型 (标准版)","contextWindow":40960,"capabilities":["Realtime-Chatting"]}],"detailPath":"groups/qwen-audio-realtime-plus.json","maxContextWindow":40960} |
62 | | -{"slug":"qwen-audio-tts","name":"Qwen-Audio-TTS","description":"Qwen-Audio-TTS是一款面向实时交互场景和高质量语音生成场景的语音合成大模型。模型支持多种小语种和中文方言,并具有Free-style 指令遵循能力、Context能力和细粒度标签控制能力,可更灵活地控制情绪、语气、角色、语速、音量等表达方式。","primaryCapability":"Realtime-Text-to-Speech","capabilities":["Realtime-Text-to-Speech"],"providers":["qwen"],"itemCount":2,"items":[{"model":"qwen-audio-3.0-tts-flash","name":"qwen-audio-3.0-tts-flash","capabilities":["Realtime-Text-to-Speech"]},{"model":"qwen-audio-3.0-tts-plus","name":"qwen-audio-3.0-tts-plus","capabilities":["Realtime-Text-to-Speech"]}],"detailPath":"groups/qwen-audio-tts.json"} |
| 62 | +{"slug":"qwen-audio-tts","name":"Qwen-Audio-TTS","description":"Qwen-Audio-TTS是一款面向实时交互场景和高质量语音生成场景的语音合成大模型。模型支持多种小语种和中文方言,并具有Free-style 指令遵循能力、Context能力和细粒度标签控制能力,可更灵活地控制情绪、语气、角色、语速、音量等表达方式。","primaryCapability":"Realtime-Text-to-Speech","capabilities":["Realtime-Text-to-Speech","TTS"],"providers":["qwen"],"itemCount":2,"items":[{"model":"qwen-audio-3.0-tts-flash","name":"Qwen-Audio-3.0-TTS-Flash","capabilities":["Realtime-Text-to-Speech"]},{"model":"qwen-audio-3.0-tts-plus","name":"Qwen-Audio-3.0-TTS-Plus","capabilities":["Realtime-Text-to-Speech","TTS"]}],"detailPath":"groups/qwen-audio-tts.json"} |
63 | 63 | {"slug":"qwen-coder-plus","name":"Qwen-Coder-Plus","description":"千问系列代码及编程模型是专门用于编程和代码生成的语言模型,性能出色,效果突出。","primaryCapability":"TG","capabilities":["TG"],"providers":["qwen-domain-model"],"itemCount":1,"items":[{"model":"qwen-coder-plus","name":"Qwen-Coder-Plus","contextWindow":131072,"capabilities":["TG"]}],"detailPath":"groups/qwen-coder-plus.json","maxContextWindow":131072} |
64 | 64 | {"slug":"qwen-coder-turbo","name":"Qwen-Coder-Turbo","description":"Qwen-Coder-Turbo模型是专门用于编程和代码生成的语言模型,推理速度快,成本低。","primaryCapability":"TG","capabilities":["TG"],"providers":["qwen-domain-model"],"itemCount":1,"items":[{"model":"qwen-coder-turbo","name":"Qwen-Coder-Turbo","contextWindow":131072,"capabilities":["TG"]}],"detailPath":"groups/qwen-coder-turbo.json","maxContextWindow":131072} |
65 | 65 | {"slug":"qwen-deep-research","name":"qwen-deep-research","description":"千问深入研究是一款面向复杂研究任务的高级智能体系统,具备多轮推理与全局规划能力,能够运用互联网搜索等多种工具,对任务进行精细化拆解,开展推理与分析,最终为用户生成可溯源、逻辑严谨的研究型报告。","primaryCapability":"TG","capabilities":["TG"],"providers":["qwen-domain-model"],"itemCount":1,"items":[{"model":"qwen-deep-research","name":"qwen-deep-research","contextWindow":1000000,"capabilities":["TG"]}],"detailPath":"groups/qwen-deep-research.json","maxContextWindow":1000000} |
|
0 commit comments