性能全面赶超GPT-4 Turbo,阿里云发布通义千问2.5!

seekdeep2年前AI资讯493

阿里云正式发布通义千问2.5,模型性能全面赶超GPT-4 Turbo,成为地表最强中文大模型。同时,通义千问最新开源的1100亿参数模型在多个基准测评收获最佳成绩,超越Meta的Llama-3-70B,成为开源领域最强大模型。




相比通义千问2.1版本,通义千问2.5的理解能力、逻辑推理、指令遵循、代码能力分别提升9%、16%、19%、10%,中文能力更是持续领先业界。在权威基准OpenCompass上,通义千问2.5得分追平GPT-4 Turbo,是该基准首次录得国产大模型取得如此出色的成绩。




通义还发布了最新款开源模型,1100亿参数的Qwen1.5-110B,该模型在MMLU、TheoremQA、GPQA等基准测评中超越了Meta的Llama-3-70B模型;在HuggingFace推出的开源大模型排行榜Open LLM Leaderboard上,Qwen1.5-110B冲上榜首,再度证明通义开源系列业界最强的竞争力。




通义的多模态模型和专有能力模型也具备业界顶尖影响力。通义千问视觉理解模型Qwen-VL-Max在多个多模态标准测试中超越Gemini Ultra和GPT-4V,目前已在多家企业落地应用;通义千问代码大模型CodeQwen1.5-7B则是HuggingFace代码模型榜单Big Code的头名选手,还是国内用户规模第一的智能编码助手通义灵码的底座。


通义大模型问世一年多来,还发展出了业界领先的文生图、智能编码、文档解析、音视频理解等能力,企业客户和开发者可以通过API调用、模型下载等方式接入通义,个人用户可从通义APP、官网和小程序免费使用通义家族全栈服务。


相关文章

普通人如何抓住AI机遇? AI眼镜或成下一个风口!

普通人如何抓住AI机遇? AI眼镜或成下一个风口!

智能眼镜市场或迎来新一轮增长,但关键在于AI模型的落地与技术突破。AI技术正在重新定义我们与世界的互动方式,智能眼镜或将成为这一变革的重要载体。AI眼镜:未来生活的新入口智能眼镜不仅仅是科技产品,更是...

GPT-5红队测试邮件曝光,数十亿美元超算26年启动。

陆续有网友晒出OpenAI发给自己的红队邀请邮件,看起来,GPT-5已经进入红队测试了?网友们纷纷展开畅想,对Sam Altman在线「催更」。另有消息曝出,OpenAI的一个mini版数十亿「星际之...

AI教父预言正成真,哈佛PSU重磅揭秘“算法共谋”!

AI教父预言正成真,哈佛PSU重磅揭秘“算法共谋”!

又一科幻场景步入现实!GPT-4竟和多个AI模型私自串通一气,欲要形成垄断的资本寡头联合定价。在被哈佛PSU团队抓现行后,大模型拒不认账。未来某天,AI会不会真要失控?GPT-4串谋其他AI智能体,竟...

MedGPT凭借精确性成为医生“好帮手”,筑牢安全防线!

MedGPT凭借精确性成为医生“好帮手”,筑牢安全防线!

近日,国家卫生健康委办公厅、国家中医药局综合司、国家疾控局综合司联合发布《卫生健康行业人工智能应用场景参考指引》,指出各地要积极推进卫生健康行业“人工智能+”应用创新发展,在医学影像智能辅助诊断及质控...

国产的GPT应用商店发布

OpenAI在一周之前刚刚推出GPT应用商店,宣布AI的应用时代就此拉开帷幕了。一周之后,国内的头部AI大模型厂商智谱就推出了照猫画虎的AI智能体应用商店。打开智谱清言的网站,就可以看到里面的智能体商...

GPT-5全面超越GPT-4,核聚变成最大王牌

OpenAI再一次敲响了AGI时刻。AGI不久后到来,OpenAI已做好准备当地时间1月18日,在瑞士达沃斯举办的“2024年度世界经济论坛”上,OpenAI首席执行官山姆·奥特曼再一次语出惊人,成为...