近日,在人工智能这个充满活力又不断面临挑战的领域内,大语言模型的“幻觉问题”犹如一座大山,一直横亘在业界面前,成为了一个极为关键的难题。
测试数据显示,在参与评估的85个大语言模型中,GLM-4-9B以98.7%的事实一致性率和100%的回答率摘得桂冠。特别值得关注的是,该模型的幻觉率仅为1.3%,这一成绩不仅位居榜首,更是超越了行业巨头OpenAI的GPT系列和Google的Gemini系列模型。
这一突破性成果标志着中国大语言模型在降低“幻觉率”方面取得重要进展,为提升AI应用的可靠性和准确性带来新的可能。这不仅体现了智谱AI在模型研发上的技术实力,也为全球AI领域树立了新的标杆。
在当前AI技术竞争日益激烈的背景下,GLM-4-9B模型的出色表现无疑将为智谱AI赢得更多关注,同时也为中国AI企业在国际舞台上赢得了更多话语权。
文明上网,理性发言,共同做网络文明传播者