国产大模型 · 子分类
多模态模型能同时处理文字、图片与音频,用于需要跨格式理解的任务,比如看图回答、按图检索。站内收录的代表产品包括元象XVERSE、书生等。
元象XVERSE是元象唯思推出的多模态对话入口,主要面向需要文本与视觉、三维内容结合处理的个人用户和企业开发者。它的核心能力在于把大模型的语言理解与生成,同元象在3D建模、虚拟人驱动和图形渲染上的技术积累结合起来,让对话不只停留在文字层面,还能延伸到图像理解、虚拟形象交互等场景。典型使用场景包括:在智能客服或虚拟导购中生成带形象和动作的交互回复,在内容创作中辅助生成三维角色设定与场景描述,在教育与展示场景里让虚拟人边讲解边呈现视觉内容。它适合对多模态交互有需求的开发者、数字人运营团队、以及希望快速搭建虚拟形象对话应用的创作者。与多数以纯文本对话为主的大模型产品相比,元象XVERSE的差异在于把3D与虚拟人能力作为底层支撑,而非仅在文本层面做问答,因此在需要形象化、空间化表达的任务中更具针对性。用户可通过官网直接体验其对话功能,并在此基础上探索更丰富的多模态应用形态。
书生是上海人工智能实验室推出的通用大模型系列,官网是它面向公众的官方体验入口,打开网页就能直接对话,不需要本地部署。它的核心能力覆盖中英文的自然语言理解与生成,支持长文本阅读、知识问答、内容写作、代码辅助、逻辑推理和多轮对话,也能处理文档解析、信息抽取这类偏实用的任务,并开源了多个参数规模的模型版本供开发者研究和二次开发。典型使用场景包括:学生和研究者用它梳理资料、解释概念、润色论文表达;职场人士用它起草邮件、会议纪要、方案初稿和翻译;程序员用它读代码、写脚本、排查报错;内容创作者用它做选题发散和文案改写。面向人群既有想零门槛体验国产大模型的普通用户,也有需要模型权重做微调、评测和行业落地的开发者与高校团队。与同类产品相比,书生的差异主要体现在两点:一是背后是上海人工智能实验室这样的科研机构,模型体系偏学术与开源路线,技术报告和权重公开程度较高,便于复现和研究;二是它不只提供一个聊天入口,还配套了工具链与开源生态,开发者可以基于同一系列模型做继续训练和垂直适配,而不是只能调用封闭接口。对希望兼顾日常使用与深入研究的用户来说,这种能直接用、也能拆开看的组合是它比较突出的特点。