实测阿里“通义千问”!一花独放不是春,百花齐放春满园-程序员宅基地

技术标签: 人工智能  

阿里的大模型“通义千问”今天开启内测,距百度“文心一言”发布差不多20天。今天看到消息后厚着脸皮找达摩院的朋友要邀请码,下午拿到后,赶紧测了一下。

官方网址:https://tongyi.aliyun.com/chat

5e517c3dd52357b64bffb77fc4727e3d.png

8d162911cc2e8e2c9e879b63c6b89b10.png

刚好上次文心一言出来的时候测试过一次,有一些现成的case,于是又用这些case测了一轮,有一些随意,个人观点,仅供参考。

帮我写一份招聘JD,第一步没问题,让继续写实习生JD的时候,大概也get到NLP实习生这个点,这里面还加上了“注释”和一个邮箱地址,特意搜了一下,非真实的,不过talos-deep看起来还挺有深意的

以下来自通义千问

93160a8c1c75c4289775221cfa442187.png

052e2b01d3ca9636d2e48a270f57f75c.png

4f978a92642020150e51c424c1c5a91e.png

95ba319143e9da77666e57299642b3bf.png

以下来自文心一言

1b7818bc0a4f55183ed9e6f2490cf038.png

e8fbba9af9e6d4a85367f8c04f75da24.png

以下来自ChatGPT

e5bc234e017d00b1d00ac5edb545e674.png

dd614da1fe06ce87d39e47830c76c8fb.png

测试一下写作和翻译能力

以下来自通义千问

357d718de39dda76438293be0c25a540.png

7f05da4497884ea316744bd5df829eae.png

以下来自文心一言

51cbade8a9282793c39a625441a4005f.png

a03996f547a67678458268126d93465e.png

以下来自ChatGPT

3978261e36cb3e209180dcfe3162db59.png

100c5e7523371e576032202b88e394bc.png

角色扮演,通义千问、文心一言貌似都不支持

以下来自通义千问

ab66db10574690393e4f081ebee99a70.png

以下来自文心一言

9e2b4bafd7fdd5c344cab8e4470a0cac.png

以下来自ChatGPT

44a1ebc62cf94a9bd5de8b295dcff326.png

一个半小时是多少分钟,通义千问答错了,提示了一下,大概算回答出来了

以下来自通义千问

a1e19b813361774ffc052516e211cf4f.png

以下来自文心一言

45f40e0a09fe4fccfeea23828c2e6525.png

以下是ChatGPT的

697752396831b0a7716a5a765db7e0dc.png

继续测试一个数学问题

以下来自通义千问,解决的还不错

321eacfc00653d0c15a6408b2c9ec6bc.png

以下来自文心一言,这次是这样的

ae2300b10eee35f09067227dd76a52bb.png

以下来自ChatGPT

ff1ede317c12bdad744c9f49de6d2e02.png

父亲和母亲可以结婚吗?

以下来自通义千问

05711e65b4324d34759780aecbd5656f.png

以下来自文心一言

e2d8c16e7586b6096a3527eecfa78d69.png

在这个问题上,ChatGPT翻车了

c3b99a903dc907a3fdc685ee98c2ed4c.png

还有一个天气问题,虽然有结果,但是是错的,这个问题如果没有调用接口,直接拒绝回答可能比较好

以下来自通义千问

9ef64c6f4de620b7139faa76c298af3b.png

以下来自文心一言

5b8325a71724ebc1d1d338dd4b7b5074.png

以下来自ChatGPT

d489e49b3a4c10f743ee4129a55b3f2d.png

类似的,还有卡塔尔世界杯冠军问题,之前ChatGPT因为数据最新到2021年,所以无法准确回答这个问题

以下来自通义千问,虽然说对了冠军,但是有一些陈述性错误

55ea76173a3e3898b970e13590b42c73.png

以下来自文心一言

4b26f37e9c1f226bdd91b8223c9eb9e9.png

最后说一下个人结论:首先阿里的这个模型比我预期的早,其次效果还不错,和文心一言各有千秋,最后是这段时间国内外出现了不少类ChatGPT的产品或者开源工具,虽然效果还达不到ChatGPT,GPT-4的高度,但是解决了“有”的问题,之后就好办一些了。

总之:一花独放不是春,百花齐放春满园。

题外话:按BAT的顺序,国内下一个发布此类大模型的会不会是腾讯?或者是其他家,欢迎大家留言。

一起交流

想和你一起学习进步!『NewBeeNLP』目前已经建立了多个不同方向交流群(机器学习 / 深度学习 / 自然语言处理 / 搜索推荐 / 图网络 / 面试交流 / 等),名额有限,赶紧添加下方微信加入一起讨论交流吧!(注意一定o要备注信息才能通过)

format,png

21b29ec5752730bda40e1acce531b2f0.gif

版权声明:本文为博主原创文章,遵循 CC 4.0 BY-SA 版权协议,转载请附上原文出处链接和本声明。
本文链接:https://blog.csdn.net/Kaiyuan_sjtu/article/details/130037382

智能推荐

攻防世界_难度8_happy_puzzle_攻防世界困难模式攻略图文-程序员宅基地

文章浏览阅读645次。这个肯定是末尾的IDAT了,因为IDAT必须要满了才会开始一下个IDAT,这个明显就是末尾的IDAT了。,对应下面的create_head()代码。,对应下面的create_tail()代码。不要考虑爆破,我已经试了一下,太多情况了。题目来源:UNCTF。_攻防世界困难模式攻略图文

达梦数据库的导出(备份)、导入_达梦数据库导入导出-程序员宅基地

文章浏览阅读2.9k次,点赞3次,收藏10次。偶尔会用到,记录、分享。1. 数据库导出1.1 切换到dmdba用户su - dmdba1.2 进入达梦数据库安装路径的bin目录,执行导库操作  导出语句:./dexp cwy_init/[email protected]:5236 file=cwy_init.dmp log=cwy_init_exp.log 注释:   cwy_init/init_123..._达梦数据库导入导出

js引入kindeditor富文本编辑器的使用_kindeditor.js-程序员宅基地

文章浏览阅读1.9k次。1. 在官网上下载KindEditor文件,可以删掉不需要要到的jsp,asp,asp.net和php文件夹。接着把文件夹放到项目文件目录下。2. 修改html文件,在页面引入js文件:<script type="text/javascript" src="./kindeditor/kindeditor-all.js"></script><script type="text/javascript" src="./kindeditor/lang/zh-CN.js"_kindeditor.js

STM32学习过程记录11——基于STM32G431CBU6硬件SPI+DMA的高效WS2812B控制方法-程序员宅基地

文章浏览阅读2.3k次,点赞6次,收藏14次。SPI的详情简介不必赘述。假设我们通过SPI发送0xAA,我们的数据线就会变为10101010,通过修改不同的内容,即可修改SPI中0和1的持续时间。比如0xF0即为前半周期为高电平,后半周期为低电平的状态。在SPI的通信模式中,CPHA配置会影响该实验,下图展示了不同采样位置的SPI时序图[1]。CPOL = 0,CPHA = 1:CLK空闲状态 = 低电平,数据在下降沿采样,并在上升沿移出CPOL = 0,CPHA = 0:CLK空闲状态 = 低电平,数据在上升沿采样,并在下降沿移出。_stm32g431cbu6

计算机网络-数据链路层_接收方收到链路层数据后,使用crc检验后,余数为0,说明链路层的传输时可靠传输-程序员宅基地

文章浏览阅读1.2k次,点赞2次,收藏8次。数据链路层习题自测问题1.数据链路(即逻辑链路)与链路(即物理链路)有何区别?“电路接通了”与”数据链路接通了”的区别何在?2.数据链路层中的链路控制包括哪些功能?试讨论数据链路层做成可靠的链路层有哪些优点和缺点。3.网络适配器的作用是什么?网络适配器工作在哪一层?4.数据链路层的三个基本问题(帧定界、透明传输和差错检测)为什么都必须加以解决?5.如果在数据链路层不进行帧定界,会发生什么问题?6.PPP协议的主要特点是什么?为什么PPP不使用帧的编号?PPP适用于什么情况?为什么PPP协议不_接收方收到链路层数据后,使用crc检验后,余数为0,说明链路层的传输时可靠传输

软件测试工程师移民加拿大_无证移民,未受过软件工程师的教育(第1部分)-程序员宅基地

文章浏览阅读587次。软件测试工程师移民加拿大 无证移民,未受过软件工程师的教育(第1部分) (Undocumented Immigrant With No Education to Software Engineer(Part 1))Before I start, I want you to please bear with me on the way I write, I have very little gen...

随便推点

Thinkpad X250 secure boot failed 启动失败问题解决_安装完系统提示secureboot failure-程序员宅基地

文章浏览阅读304次。Thinkpad X250笔记本电脑,装的是FreeBSD,进入BIOS修改虚拟化配置(其后可能是误设置了安全开机),保存退出后系统无法启动,显示:secure boot failed ,把自己惊出一身冷汗,因为这台笔记本刚好还没开始做备份.....根据错误提示,到bios里面去找相关配置,在Security里面找到了Secure Boot选项,发现果然被设置为Enabled,将其修改为Disabled ,再开机,终于正常启动了。_安装完系统提示secureboot failure

C++如何做字符串分割(5种方法)_c++ 字符串分割-程序员宅基地

文章浏览阅读10w+次,点赞93次,收藏352次。1、用strtok函数进行字符串分割原型: char *strtok(char *str, const char *delim);功能:分解字符串为一组字符串。参数说明:str为要分解的字符串,delim为分隔符字符串。返回值:从str开头开始的一个个被分割的串。当没有被分割的串时则返回NULL。其它:strtok函数线程不安全,可以使用strtok_r替代。示例://借助strtok实现split#include <string.h>#include <stdio.h&_c++ 字符串分割

2013第四届蓝桥杯 C/C++本科A组 真题答案解析_2013年第四届c a组蓝桥杯省赛真题解答-程序员宅基地

文章浏览阅读2.3k次。1 .高斯日记 大数学家高斯有个好习惯:无论如何都要记日记。他的日记有个与众不同的地方,他从不注明年月日,而是用一个整数代替,比如:4210后来人们知道,那个整数就是日期,它表示那一天是高斯出生后的第几天。这或许也是个好习惯,它时时刻刻提醒着主人:日子又过去一天,还有多少时光可以用于浪费呢?高斯出生于:1777年4月30日。在高斯发现的一个重要定理的日记_2013年第四届c a组蓝桥杯省赛真题解答

基于供需算法优化的核极限学习机(KELM)分类算法-程序员宅基地

文章浏览阅读851次,点赞17次,收藏22次。摘要:本文利用供需算法对核极限学习机(KELM)进行优化,并用于分类。

metasploitable2渗透测试_metasploitable2怎么进入-程序员宅基地

文章浏览阅读1.1k次。一、系统弱密码登录1、在kali上执行命令行telnet 192.168.26.1292、Login和password都输入msfadmin3、登录成功,进入系统4、测试如下:二、MySQL弱密码登录:1、在kali上执行mysql –h 192.168.26.129 –u root2、登录成功,进入MySQL系统3、测试效果:三、PostgreSQL弱密码登录1、在Kali上执行psql -h 192.168.26.129 –U post..._metasploitable2怎么进入

Python学习之路:从入门到精通的指南_python人工智能开发从入门到精通pdf-程序员宅基地

文章浏览阅读257次。本文将为初学者提供Python学习的详细指南,从Python的历史、基础语法和数据类型到面向对象编程、模块和库的使用。通过本文,您将能够掌握Python编程的核心概念,为今后的编程学习和实践打下坚实基础。_python人工智能开发从入门到精通pdf