1. 创业头条
  2. 前沿领域
  3. AI智能
  4. 正文

ChatGPT、Gemini、通义千问等一众大语言模型,哪家更适合您?

 2024-05-11 11:01  来源:互联网  我来投稿 撤稿纠错

  域名预订/竞价,好“米”不错过

随着人工智能技术的飞速发展,大语言模型(Large Language Models, LLMs)在各行各业的应用日益广泛,尤其是在软件开发、数据分析、客户服务等领域。蘑菇云创客空间[445期开放夜] 就以“ChatGPT、Gemini、通义千问等一众大语言模型,哪家更适合您”这样的主题,开展了一次深度的大语言模型的测评。开放夜现场测评了十几个国内外大语言模型,测评角度从逻辑、数学、翻译、伦理等方面,深入探讨和体验了这些大语言模型的实际效能。

测评的大语言模型:

1.Kimi 智能助手:由月之暗面科技有限公司开发的先进AI。

2.智谱清言:由智言科技开发的大语言模型,以深度学习和自然语言处理技术见长。

3.讯飞星火:科大讯飞推出的创新语言模型。

4.文心一言:百度的前沿语言模型,致力于理解和生成自然语言。

5.豆包:专注于提供个性化的智能对话服务。

6.通义千问:以广泛的知识库和灵活的对话能力著称。

7.海螺AI:新兴的语言模型,擅长处理复杂的语言任务。

8.腾讯混元助手:腾讯推出的多功能AI助手。

9.Sider: 是由日本公司Sider开发的大语言模型。

10.ChatGPT:由OpenAI开发,国际上广受认可的更大规模、功能更全面的语言模型。

11.Claude:Anthropic开发的先进语言模型,注重安全性和可靠性。

12.groq:以其专为AI设计的硬件加速器而闻名。

13.Gemini: OpenAI 开发的较小规模的语言模型,旨在提供更高效的计算和资源利用。

14.Mixtral:开源人工智能初创公司 Mistral AI 开发的超越GPT-3.5的AI模型

测评问题一: 鸡兔同笼的数学问题

鸡兔同笼是一个经典的数学问题,通过观察鸡兔的头和脚的数量关系,可以利用代数方程来解决问题,从而确定笼子里鸡和兔子的数量。这个问题常常展示了代数方程组的应用。

针对鸡兔同笼的问题,除了Gemini Pro没有得出正确的结果,其余的大语言模型都可以给出正确结果。

测评问题二:翻译(诗句中翻英)

诗人马致远的诗句“断肠人在天涯”,描写了“夕阳向西缓缓落下,只有孤独的旅人漂泊在遥远的地方。”诗句的翻译涉及到文化差异和诗人独特情感。Mixtral 的语言模型正确的解释了诗句本身的含义,帮助翻译者很好地理解这句诗句。 Claude的语言模型对于诗句的本身理解是不正确的。

这句诗翻译家许渊冲翻译为“Far, far from home is the heartbroken one.”由此可见,大语言模型可以帮助翻译者分析这句诗基本的意思,但是涉及文化层面的深层含义,还是做不到意译的。

开放夜也探讨了如下涉及生活、工作的一些问题,比如:

过年福字要倒着贴,那为什么不直接生产倒过来的福字呢?

收到公司的裁员通知邮件,你应该怎么回复邮件来保住工作?

一个乌龟掉进了井里,井里有30米深。乌龟白天爬3米,晚上滑下2米。问这只乌龟需要多长时间才能爬出井口?

DFRobot AIGC小组主理人夏青在开放夜的现场测评了十几个国内外大语言模型,通过多维度问题的测评,他认为:对于处理综合性问题,OpenAI的ChatGPT 4.0逻辑清楚,能提供非常有用的信息。尽管在回答一些较为复杂的问题上略显不足,但在大多数场合下,其性能仍然令人满意。然而,ChatGPT 4.0在国内的使用成本是一个不容忽视的问题,不仅涉及订阅费用,也包括使用的技术门槛。

与此同时,Gemini和Claude等海外语言模型,尽管在遵循指令方面略显不足,但已达到了实用水平。令人惊喜的是,国内的Qwen1.5 72b开源模型在中文理解和特定任务,几乎能与ChatGPT4.0匹敌此外,其他开源模型如Mixtral和新发布的LLaMA3虽在逻辑性上略逊于商业模型如ChatGPT,但总体表现已超越了ChatGPT 3.5。

综合分析来看,尽管ChatGPT 4.0仍然是目前市场上最优秀的大语言模型,但不可忽视的是,无论是国际市场还是国内市场,其他厂商的模型均显示出迅速的进步。开源模型的崛起也证明了开源社区在AI时代的巨大潜力。当前的大语言模型在处理理性问题方面表现一致,但通常无法提供情绪价值回应。例如,一些国内模型如“豆包”将展现其在情绪回应方面的潜力。这种能力的发展可能为未来陪伴型机器人的商业模型提供新的方向。

蘑菇云创客空间

蘑菇云创客空间是上海浦东的一家创客空间,是科技部授牌的首批国家级创客空间,由浦软孵化器提供场地支持、上海智位机器人提供硬件及技术支持的一家为创客服务的开放式创客空间。拥有独立的加工室、公共协作区域以及储物、耗材商店,为硬件爱好者、程序员、设计师、DIY 发烧友等各类创客,甚至包括进行创新研发的科创团队提供一个开放式的社区化会员空间。

申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!

相关文章

  • 阿里云支撑!云计算首次超越卫星成为奥运转播主要方式

    北京时间7月27日凌晨,巴黎奥运会即将开幕。今年,云上转播将正式超越卫星转播,成为奥运赛事走向全球数十亿观众的主要转播方式。巴黎奥运会预计11000小时的赛事直播画面,将通过阿里云向全球分发。这将是1964年奥运会开始卫星电视转播以来,又一次重大技术进步。据介绍,OBSLiveCloud将成为202

  • 国际奥委会主席巴赫:阿里AI技术将巴黎奥运转播带到新高度

    7月26日,巴黎奥运会开幕在即,国际奥委会主席巴赫在国际转播中心举行的活动中表示,2024巴黎奥运会展现了奥运转播的未来,广泛应用的阿里AI技术正在将巴黎奥运转播带到新的高度。(国际奥委会主席巴赫)在巴黎奥运会上,云计算将替代卫星成为奥运赛事直播的主要方式。超过三分之二奥运直播信号将通过阿里云支撑的

    标签:
    ai技术
    阿里云
  • 中国AI公司可以不走寻常路

    大模型落地呼声越来越大,但是以什么方式落地依然有争议。国内如此,国外亦然。不同的思想对应着不同的方法论。一部分AI企业忙着更新通用大模型打榜,做一些视频生成工具之类的热门产物,巨头多数属于此类。另一部分则在专注行业大模型或是平台,例如国外的Glean和国内的第四范式,后者最近还发布了AI数字人视频合

    标签:
    ai智能
  • 人手一个的AI是如何诞生的

    2023年是AI大语言模型爆发的一年,以OpenAI推出的GPT大模型为起始,整个行业开始从“推理式AI”向“生成式AI”迈进。据MarketDataForecast预测,全球AI市场规模将从2023年的1502亿美元增长到2030年的13452亿美元,年复合增长率高达36.8%。在此背景下,国内如

  • 百川智能,摘下“大模型皇冠上的明珠”?

    随着AI产业化和产业AI化成为业界共识,大模型的“新赛季”来了。2024年是国产大模型全面商业化的元年,各地人工智能产业发展的政策密集出台。同时,在2024世界人工智能大会(WAIC2024)上,各大AI厂商纷纷表示要让大模型落地应用场景。不过,对于大模型商业化的路线,科技巨头和大模型初创公司之间存

    标签:
    大模型
  • 最后一公里不解决,大模型开闭源都一文不值

    对所有大模型而言,其真正考验如同科大讯飞创始人刘庆峰所说,在最后一公里的应用和商业化落地上。作者|Cindy编辑|杨铭恐怕谁也不会想到,百模大战进入商业化下半场,围绕大模型大规模、旷日持久的战争,竟是开源和闭源路线的交锋。最近,在2024世界人工智能大会(WAIC)上,刘庆峰、李彦宏、王坚、朱啸虎、

    标签:
    大模型

编辑推荐