
紫东太初是由中国科学院自动化研究所和武汉人工智能研究院联合研发的新一代多模态大模型。该模型支持多轮问答、文本创作、图像生成、3D理解、信号分析等全面问答任务,拥有更强的认知、理解、创作能力,为用户带来全新的互动体验。
| 能力维度 | 具体表现 |
|---|---|
| 语言能力 | 中文推理能力达到GPT-4o的95%,中文写作能力相对于GPT-4o超出3%,支持128K长文本 |
| 视觉语言能力 | 中文视觉对话能力相对于GPT-4o超出2%,OCR类能力相对于GPT-4o超出3%,视觉定位能力超越专有模型 |
| 图文音能力 | 零样本语音情感识别能力达到领先水平,图文音混合理解能力相比Gemini-1.5-pro超出6% |

专属知识库和联网搜索实现大模型检索增强,有效缓解幻觉,加速知识学习,使得大模型更加实用和可信。

关注图文音三模态数据之间的关联特性,支持图文问答、视觉定位、视觉指代、OCR问答、音乐理解。

多种艺术风格的AI作画,精准控制绘画细节;文本指令可智能作曲生成音乐片段。
基于点云数据的3D场景理解和物体感知能力。
支持雷达信号鉴别与知识交互,可借助模型快速掌握信号基本来源及参数等。
紫东太初可以理解三维场景、信号等数字物联时代的重要信息,完成了音乐、图片和视频等数据之间的跨模态对齐,能够处理音乐视频分析、三维导航等多模态关联应用需求,并可实现音乐、视频等多模态内容理解和生成。
紫东太初4.0已开启多模态智能体时代,致力于为用户提供更智能、更全面的AI服务体验。
官方网站:https://taichu-web.ia.ac.cn
Copyright © 2025 中科紫东太初(北京)科技有限公司