(原标题:国产AI大模子高考收货单出来了:讯飞星火取得笼统第一)
$科大讯飞(SZ002230)$
跟着高考的完了,天下各地的高三学子们终于可以卸下千里重的包袱,闲居欢迎假期。与往年不同的是,本年的高考战场上还有一支如胶投漆的军队引东说念主谛视——国产东说念主工智能大模子。
在这场特殊的高登科,包括搜狐科技、潇湘晨报、量子位等多家巨擘媒体对近10款国产东说念主工智能大模子进行了高考作文、数学、物理三个科联想评测,并公布了收货。咱们来一皆总结一下:
最初进行的是高考作文的评测。在搜狐科技的评测中,三位资深语文熏陶当作巨擘群众为各大模子的作文打分。腾讯元宝和百度文心一言以荒谬50分的收货位居前线,智谱清言、字节豆包与讯飞星火则比肩第三。Kimi、阿里通义、百川、海螺排行相对靠后。
而在潇湘晨报的“AI写稿”评测中,讯飞星火不仅平平分位居首位,且取得了全场最高分56分。潇湘晨报邀请湖南知名作者、剪辑当作阅卷憨厚,对国内五大AI大模子居品——百度文心一言、讯飞星火、阿里通义千问、字节豆包、腾讯元宝的高考作文进行评分,经由四位阅卷憨厚的笼统打分,讯飞星火以49分的平平分高居首位。
给讯飞星火打出“全场最高分”56分的阅卷憨厚暗示:“本文不雅点了了,阐明协调且层层鼓动,许多句子都八成有劲,颇有想想性。要是是某个学生写的,无疑是辛苦的佳作。”另外,从网友的热点挑剔中也能看出讯飞星火摘得高分的原因。
网友@2024:嗅觉星火好点,更像作文,有些更像复兴问题。
网友@烟花绽放的节日:讯飞星火更有高考味。
接下来是数学科联想较量。在搜狐科技的数学评测中,讯飞星火、文心一言、豆包均以63%的正确率位列第一梯队,智谱清言、阿里通义则以50%的正确率位居第二梯队,其他大模子相对过时。
在量子位的高考数学评测中,固然莫得给出详备收货单,但展示了各家大模子详备的解题想路,交由网友打分,通过网友的投票打分可以看出,讯飞星火的“识图+解数学题”能力收到了最高认同,位居自后的分辩是Kimi、通义千问、文心一言、豆包等。
临了是高考物理的测试。在量子位的评测中,阿里通义千问与讯飞星火以71.4%的准确率高居第一梯队,而Kimi、海螺和腾讯元宝则以42.9%的准确率位于第二梯队。百川百小应和万知答对一题位于第三梯队。
文心一言、豆包、天工、智谱清言、参谋因为出现了不同进度读图失败的问题,在顺利识别的题目中,参谋和文心一言的正确率为2/4,即正确率为28.6%;豆包、天工、智谱清言正确率为1/2,即正确率为14.3%。
笼统以上媒体在作文、数学、物理三门科联想收货,咱们得出了2024年东说念主工智能大模子高考“收货单”。来自科大讯飞的讯飞星火以52.49分高居第别称,通义千问、文心一言分辩位列第二、第三名,而Kimi、字节豆包、海螺AI等其他大模子也有可以的施展。
第别称:52.49 讯飞星火
第二名:46.08 通义千问
第三名:37.67 文心一言
第四名:34.68 Kimi
第五名:33.57 字节豆包
第六名:31.92 海螺AI
第七名:30.61 腾讯元宝
第八名:30.28 智谱清言
第九名:21.56 百川百小应
尽管评测时势可能不够严谨科学,但此次大模子高考无疑展示了国产东说念主工智能在多个学科的优秀施展和长足跳动,尤其是讯飞星火的施展号称“文理兼修”!期待国产大模子再接再厉,在来岁的高登科取得愈加出色的收货!
金沙巴黎人娱乐城app娱乐