通义千问大语言模型
支持自然语言理解、文本生成、视觉理解、音频理解、工具使用、角色扮演和 AI Agent 互动。
通义实验室
通义实验室:全球领先的 AI 大模型通义实验室汇聚全系列大模型、行业资讯与前沿应用。通义千问具备自然语言理解、文本生成、视觉理解、音频理解、工具使用、角色扮演和 AI Agent 互动等能力;通义万相支持图像、视频和声音等多模态生成。
围绕大模型研究、开发与行业应用,通义实验室提供千问语言模型、万相视觉生成模型以及面向数据处理、内容安全和智能终端的能力介绍。
支持自然语言理解、文本生成、视觉理解、音频理解、工具使用、角色扮演和 AI Agent 互动。
基于多模态统一框架,支持图像、视频和声音生成,并覆盖图文混排、视频换人和图生动作等方向。
面向玩具、穿戴设备、陪伴机器人和智能家居等消费电子终端,提供多模态交互能力。
支持实体识别、电商信息提取、长文档归纳总结、文本分析打标等非结构化数据处理场景。
结合大模型分析多模态数据,支持内容安全审核、风险设备识别和互联网反欺诈。
查看通义实验室公开展示的模型上新与系列发布信息。
通义实验室页面公开展示了 Qwen3-VL-Flash 上架百炼的动态。
通义实验室页面公开展示 Wan2.6 系列模型,包含 R2V 视频角色参考生成、I2V 智能多镜头叙事、T2V 自然音画同步、T2I 图像生成等方向。
通过官方入口了解研究成果、API平台、模型文档、智能体搭建和开源社区资源。