GPT-4 Turbo 击败 Claude 3,重新夺回 “最佳AI模型” 称号

AI 概述
OpenAI 最新推出的更新版 GPT-4Turbo 上周已经面向开发人员和付费 ChatGPT 订阅者提供。当推出这一模型时,OpenAI 表示新的 GPT-4Turbo 从前作中进行了多项改进,而用户们也发现这一点确实如此。 从上周四开始,更新版的 GPT-4Turbo,即 gpt-4-turbo-2024-04-09,重新夺回了 Large Model Systems Organization(LMSYS)C...

OpenAI 最新推出的更新版 GPT-4Turbo 上周已经面向开发人员和付费 ChatGPT 订阅者提供。当推出这一模型时,OpenAI 表示新的 GPT-4Turbo 从前作中进行了多项改进,而用户们也发现这一点确实如此。

从上周四开始,更新版的 GPT-4Turbo,即 gpt-4-turbo-2024-04-09,重新夺回了 Large Model Systems Organization(LMSYS)Chatbot Arena 的榜首位置,这是一个众包的开放平台,用户可以在其中评估大型语言模型(LLM)。

GPT-4 Turbo 击败 Claude 3,重新夺回 “最佳 AI 模型” 称号

在 Chatbot Arena 中,用户可以与两个 LLMs 并排聊天,比较它们的回答,而不知道每个模型的身份。这些结果被用于排名 Chatbot Arena 中的 82 个 LLMs,包括市场上所有最受欢迎的 LLMs,如 Gemini Pro、Claude3 系列 LLMs 和 Mistral-Large-2402。

GPT-4 Turbo

截至 4 月 13 日的最新 Chatbot Arena 更新,更新版的 GPT-4Turbo 在整体、编码和英语类别中处于领先地位。这意味着不到一个月之后,Anthropic 的 Claude3Opus 在整体类别中被挤到第二名,其后是 GPT-4Turbo 的旧版本 GPT-4-1106-preview。

这些结果可能归因于 gpt-4-turbo-2024-04-09 在编码、数学、逻辑推理和写作能力方面的改进,表现更高于一系列用于测试 AI 模型熟练程度的基准测试。想要自行比较 gpt-4-turbo-2024-04-09 与其他 LLMs 的表现?可以访问 Chatbot Arena 网站,点击 “Arena(side-by-side)” 选项,选择要比较的模型。

GPT-4Turbo

值得注意的是,由于您知道侧边模式中模型的身份,您将无法进行投票。如果您想要进行投票,并让其计入排行榜,您可以使用 “Arena(battle)” 选项将随机模型进行比较。如果您想要跳过测试,直接使用 gpt-4-turbo-2024-04-09 在 ChatGPT 中,需要成为 ChatGPT Plus 订阅者,费用为每月 20 美元。

以上关于GPT-4 Turbo 击败 Claude 3,重新夺回 “最佳AI模型” 称号的文章就介绍到这了,更多相关内容请搜索码云笔记以前的文章或继续浏览下面的相关文章,希望大家以后多多支持码云笔记。

「点点赞赏,手留余香」

0

给作者打赏,鼓励TA抓紧创作!

微信微信 支付宝支付宝

还没有人赞赏,快来当第一个赞赏的人吧!

声明:本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如若内容造成侵权/违法违规/事实不符,请将相关资料发送至 admin@mybj123.com 进行投诉反馈,一经查实,立即处理!
重要:如软件存在付费、会员、充值等,均属软件开发者或所属公司行为,与本站无关,网友需自行判断
码云笔记 » GPT-4 Turbo 击败 Claude 3,重新夺回 “最佳AI模型” 称号

发表回复