首页 > 科技 > 正文
Qzone
微博
微信

昆仑万维:天工通用大模型推理能力超过GPT-3.5和LLaMA2

科技 北京商报网 2023-09-19 11:13

北京商报讯(记者 杨月涵)9月16日,昆仑万维发布消息称,在权威推理榜单Benchmark GSM8K 测试中,昆仑万维自研的通用基座大模型天工大模型以80%的正确率脱颖而出,大幅领先GPT-3.5(57.1%)和LLaMA2-70B(56.8%),“标志着天工大模型的推理能力达到全球领先,接近GPT-4”。

消息提到,天工大模型不仅在推理性能上有着强大的竞争力,在MMLU、C-EVAL、HumanEval等三项数据集测试中也同样表现出色。在MMLU数据集测试中,天工大模型以65%准确率超越了LLaMA-65B的63.4%;在C-EVAL数据集测试中,天工大模型以65%准确率超越了GPT3.5的54.4%。在HumanEval数据集测试中,天工大模型以37.2%的准确率超过了PaLM-540B(26.2%)、LLaMA-65B(23.7%)、LLaMa2 -70B(30.5%)。

【以上内容转自“北京商报网”,不代表本网站观点。 如需转载请取得北京商报网站许可,如有侵权请联系删除。】

 

延伸阅读:

 

责任编辑: cxr4186

责任编辑: cxr4186
人家也是有底线的啦~
广告
Copyright © 2018 TOM.COM Corporation, All Rights Reserved 雷霆万钧版权声明
违法信息/未成年人举报:010-85181169     举报邮箱/未成年人举报:jubao@tomonline-inc.com