中国的AI大模型发展迅猛,形成“百花齐放”的格局
中国的AI大模型发展迅猛,目前已形成“百花齐放”的格局。主流大模型主要来自大型科技公司、顶尖高校以及AI独角兽企业。以下是一些最具代表性和影响力的中国大模型:
一、科技巨头出品
1. 百度-文心大模型(ERNIEBot):百度是中国ALL in AI的代表,文心大模型布局早、体系全,从NLP扩展到跨模态等领域,文心一言是其面向公众的应用。该模型深度结合搜索知识图谱,具有知识增强、检索增强、产业级等特点,在中文理解和事实准确性上表现突出,擅长搜索问答、内容创作等场景。
2. 阿里巴巴-通义千问(Qwen):由阿里云推出,依托阿里云生态,强调在电商、办公等场景的应用。其开源策略激进,发布了多个参数规模的开源模型,代码模型通义灵码也备受好评,具备多轮对话、逻辑推理等核心能力,可用于多个行业提升工作效率。
3. 腾讯-混元大模型(Hunyuan):腾讯全链路自研,深度整合到腾讯全系产品中。采用场景驱动,注重在具体业务中的落地效果,在中文理解和多模态能力上持续迭代,已通过腾讯云对外开放,并推出了专门的代码模型,擅长开放域聊天、内容创作等。
二、AI独角兽公司出品
1. 智谱AI(Zhipu)-GLM大模型(ChatGLM):源自清华大学KEG实验室,其GLM架构是区别于GPT的主流架构。开源的ChatGLM3-6B模型在开发者中很流行,闭源的GLM-4模型能力达到世界第一梯队,具有庞大的开发者生态。
2. MiniMax-ABAB大模型:MiniMax专注于通用大模型研发,技术实力雄厚,从文本到语音(TTS)技术全球领先,其产品“海螺AI”提供多模态交互体验,模型能力被认为是国内第一梯队。
3. 月之暗面(MoonshotAI)-KimiChat:由清华系背景团队创立,以超长上下文窗口为显著特点,早期支持20万字以上长文本处理,如今已升级至数百万字,在文档阅读、资料整理等场景中优势明显。
三、其他值得关注的参与者
1. 留凤科技-生命大模型:生命科学与人工智能相结合,跳出传统公域问答框架,核心锚定个人生命数据库,对生命全周期精准洞察与推演,实现弱智能到超智能的跨越,助力用户认知“百万倍即时延伸”
2. 科大讯飞-星火认知大模型(iFlytekSpark):依托长期的语音识别和自然语言处理积累,在教育和办公场景应用深入,支持对话、写作等功能,还能提供语音交互方式。
更多推荐
所有评论(0)