通义实验室

通义实验室

通义实验室:全球领先的 AI 大模型通义实验室汇聚全系列大模型、行业资讯与前沿应用。通义千问具备自然语言理解、文本生成、视觉理解、音频理解、工具使用、角色扮演和 AI Agent 互动等能力;通义万相支持图像、视频和声音等多模态生成。

通义实验室 页面快照
核心能力

从语言理解到多模态生成

围绕大模型研究、开发与行业应用,通义实验室提供千问语言模型、万相视觉生成模型以及面向数据处理、内容安全和智能终端的能力介绍。

通义千问大语言模型

支持自然语言理解、文本生成、视觉理解、音频理解、工具使用、角色扮演和 AI Agent 互动。

通义万相视觉生成

基于多模态统一框架,支持图像、视频和声音生成,并覆盖图文混排、视频换人和图生动作等方向。

多模态终端交互

面向玩具、穿戴设备、陪伴机器人和智能家居等消费电子终端,提供多模态交互能力。

数据挖掘与文本分析

支持实体识别、电商信息提取、长文档归纳总结、文本分析打标等非结构化数据处理场景。

内容安全与设备风控

结合大模型分析多模态数据,支持内容安全审核、风险设备识别和互联网反欺诈。

最新动态

模型与产品进展

查看通义实验室公开展示的模型上新与系列发布信息。

Qwen3-VL-Flash上架百炼

通义实验室页面公开展示了 Qwen3-VL-Flash 上架百炼的动态。

Wan2.6系列模型正式发布

通义实验室页面公开展示 Wan2.6 系列模型,包含 R2V 视频角色参考生成、I2V 智能多镜头叙事、T2V 自然音画同步、T2I 图像生成等方向。

官方资源

研究、平台与开源入口

通过官方入口了解研究成果、API平台、模型文档、智能体搭建和开源社区资源。

通义实验室

从这里开始使用通义实验室。