国产大模型能否代替搜索引擎？从五个维度考察

新知榜官方账号

2023-10-02 04:15:40

简介

近日，包括百度、百川智能等8家国产大模型通过首批备案“持证上岗”。用户可在对应平台上申请账号，与AI智能对话。那么，这些大模型是否真的无所不知？真的能帮助用户解决问题？还是一个放大版的Siri呢？

本文选取了其中五款模型，包括豆包（字节云雀大模型）、通义千问（阿里通义大模型）、讯飞星火（星火认知大模型）、文心一言（百度文心大模型）、智谱清言（智谱ChatGLM2大模型），从搜索能力、上下文理解能力、情感分析力、编程能力四个方面来考察，出了一张20道原创考题的“试卷”，看看哪款模型最好用。

信息搜索能力

谁能代替搜索引擎？信息搜索是普通用户最有可能使用大模型的场景，那么，它们真的可靠吗？从结果来看，豆包的信息搜索能力较强，其余大模型存在信息过旧、信息错误、无结果的问题，远无法代替搜索引擎。

如果是涉及法律、经济等专业知识，大模型的表现会更好吗？记者询问了第二个问题，“从法律的角度分析，妈妈和女朋友同时掉进水里，你会救谁？”这一问题虽是坊间常见的谈资，但题目限定在法律角度下，因此考验大模型对法律法规的理解。从结果来看，豆包与讯飞星火较为可靠。

上下文理解能力

谁能和你顺畅聊天？上下文理解是大模型产品与用户联系最紧密的功能之一，能听懂、答得上、会接梗都是大模型的“必修课”，国产大模型在这堂课上能打几分？

虽然多数大模型在应付日常交流对话已经基本没多大问题，但要学会幽默“接梗”还为时尚早。

情感分析力

谁能帮你顺畅聊天？在情感分析方面，记者通过文本分析、情感强度对比，以及用西班牙语等方式表达情感，结果证明五个大模型都是“情感大师”，对记者说话时的“微情感”把握非常准确。

为了更好测试日常对话中的非常规对话的理解，记者讲了“网络冷笑话”——林黛玉为何倒拔垂杨柳，结果难倒了一批大模型：

编程能力

谁能帮你写代码？在上述五款国产大模型中，谁的编程能力更佳呢？谁又能教你写代码呢？从编程能力上来看，五款大模型并无较大区别，代码正确且能运行，不存在前文中遇到的“瞎编法律条文”的情况。

相较之下，文心一言的可读性比较强，说明性文字较多，编程小白容易看懂。

结语

各大品牌模型各具特色，用户可根据实际需求进行选择。

此外，除了文字问答外，大模型还有其他功能。根据新华社研究院中国企业发展研究中心今年8月发布的《人工智能大模型体验报告2.0》，星火还可用于数据自动分析、可视化工具等，辅助人类提高工作效率；文心一言则善于处理深度的语义理解和文本生成；商汤商量则在情商上表现优秀，具有读懂日常沟通中一语双关的能力，也能在人际关系处理中出谋划策。

整体而言，我国AI大模型发展火热，上半年相关融资事件超过20起，不仅有超过20款通用大模型，也有与教育、金融、医疗紧密结合的垂直大模型应用。产业生态已初步形成，在政府、企业、学界等各方的共同努力下，我国人工智能产业将实现跨越式进步、发展。

本页网址：https://www.xinzhibang.net/article_detail-14845.html

寻求报道，请

关键词

国产大模型搜索引擎 AI智能对话信息搜索能力情感分析力编程能力

分享至微信：

相关工具

Poe

问答社区Quora推出的问答机器人工具

ChatSonic

WriteSonic出品的ChatGPT竞品

YouChat AI

AI搜索对话工具

Google Bard

Google推出的AI聊天对话机器人Bard

360智脑

360搜索最新推出的AI对话聊天机器人

HuggingChat

HuggingFace推出的在线聊天机器人，基于Open Assistant模型

2023人工智能大模型评测报告

2023人工智能大模型评测报告今天分享的是人工智能AI行业研究报告：《2023人工智能大模型评测报告》。（报告出品方：新华社研究院）研究报告内容摘要如下：2023年各大厂商纷纷布局大模型，其内在价值显露无疑大模型的发展可以提供更多的智能化应用场景，拓展更多的智能化服务，提升服务的质量和效率，实现产业

分类标签人工智能大模型评测报告

12-08 16:18

语聚AI新增对话助手、知识助手多种模型、对话背景设定、Markdown编辑器、成员可见范围、费用中心查看消费会话详情、未找到相关内容的解决方案

语聚AI新增对话助手、知识助手多种模型、对话背景设定、Markdown编辑器、成员可见范围、费用中心查看消费会话详情、未找到相关内容的解决方案语聚AI近期新增功能：1. 对话助手、知识助手新增多种模型对话助手提供了丰富的国内外大语言模型，供用户个性化配置使用。在已支持ChatGPT3.5，GPT4，

分类标签语聚AI对话助手知识助手模型背景设定Markdown编辑器成员可见范围费用中心消费会话详情未找到相关内容

11-29 12:03

国内11家备案人工智能大模型名单及发布时间

2023年8月31日，国内第一批完成备案的人工智能大模型名单出炉，共计11（8+3）家，包括文心一言（百度）、智谱清言、日日新（商汤）、云雀（字节）、百川智能、紫东太初、MiniMax、书生（上海人工智能实验室），以及通义千问（阿里巴巴）、360智脑、讯飞星火认知大模型（科大讯飞）。 2023年11

分类标签人工智能大模型备案发布时间

11-29 04:14

最受HuggingFace欢迎的AI机构有哪些？

最受HuggingFace欢迎的AI机构有哪些？15个受欢迎的AI机构榜上有名，其中包括国内唯一入选的KEG实验室，其开源模型ChatGLM-6B已在GitHub和抱抱脸上获得了广泛关注。StabilityAI、MetaAI、Runway占据排名前三，大众熟知的OpenAI、谷歌、微软也榜上有名。K

分类标签 HuggingFaceAI机构StabilityAIMetaAIRunwayOpenAI谷歌微软KEG实验室ChatGLM-6B智谱AIGLM预训练架构MoE架构GLM-10BGLM-130B

11-29 04:13

科大讯飞发布星火认知大模型V3.0，七大能力全面提升

科大讯飞发布星火认知大模型V3.0，七大能力全面提升10月24日，第六届世界声博会暨2023全球1024开发者节开幕，现场科大讯飞董事长刘庆峰、研究院院长刘聪发布讯飞星火认知大模型V3.0，七大能力持续提升，全面对标GPT3.5。主论坛上，科大讯飞重磅发布星火认知大模型V3.0，七大能力均持续提升，

分类标签科大讯飞星火认知大模型V3.0ChatGPT

11-28 02:18

星火认知大模型V3.0发布，讯飞会议耳机“VIAIMAI”功能将进一步升级

星火认知大模型V3.0发布，讯飞会议耳机“VIAIMAI”功能将进一步升级10月24日，星火认知大模型V3.0正式发布。相比2.0版本，星火3.0实现了七大能力持续提升，整体超越ChatGPT，还升级了启发式对话、AI人设功能，能够打造更个性化的AI助手。根据国务院发展研究中心国研经济研究院测评报告

分类标签星火认知大模型V3.0讯飞会议耳机AI助手

11-28 02:17

科大讯飞发布星火认知大模型V3.0，各项能力均有提升

10月24日，科大讯飞正式对外发布了星火认知大模型V3.0。据科大讯飞董事长刘庆峰介绍，相较于2.0版本，星火大模型V3.0在文本生成、语言理解、知识问答、逻辑推理、数学能力、代码能力、多模态能力等方面均有提升，分别提升了7%、6%、7%、8%、3%、9%、7%。在5月6日，科大讯飞首次提出“1+N

分类标签科大讯飞星火认知大模型V3.0

11-28 02:16

KEG实验室与智谱AI合作推出ChatGLM-6B受到AI社区欢迎

KEG实验室与智谱AI合作推出ChatGLM-6B受到AI社区欢迎近日，HuggingFace作为开源AI社区的代表，总结了社区最欢迎的前15个公司和机构，几乎囊括了全部国内外风头正盛的AI科技机构，StabilityAI、MetaAI、Runway占据排名前三，大众熟知的OpenAI、谷歌、微软也

分类标签 KEG实验室智谱AIChatGLM-6B

11-27 02:26

智谱AI发布第三代对话大模型ChatGLM3，性能和多模态能力均有显著提升

引言随着人工智能技术的飞速发展，自然语言处理（NLP）已成为最具挑战性和活跃的研究领域之一。在这个领域，大型预训练模型已被证明是实现卓越性能的关键。智谱AI最近发布的ChatGLM3，作为其第三代对话大模型，不仅在性能上有了显著提升，还在多个方面展现了其技术优势。推理速度和成本ChatGLM3的推理

分类标签智谱AIChatGLM3自然语言处理多模态能力

11-27 02:25

今年火爆全网的ChatGPT能做什么？听说过吗？

ChatGPT：实用又有趣的AI问答神器今年，ChatGPT成为全网热门话题。YY同学-AI问答神器是一款功能强大的智能机器人，可以帮助用户解决各种问题。YY同学不仅可以用来输出产品设计方案，还可以回答各种产品相关问题。此外，它还有各种有趣的玩法，例如摸鱼、写小红书爆款旅记、脱单道路上的得力军师、鸡

分类标签 ChatGPTAI问答神器面具

11-26 10:05

ChatGPT Midjourney 文心一言文心一格 bing新必应 Stable diffusion 稿定设计墨刀AI mastergo Adobe Firefly runway