GPT-4 Turbo 击败 Claude 3，重新夺回 “最佳AI模型” 称号

OpenAI 最新推出的更新版 GPT-4Turbo 上周已经面向开发人员和付费 ChatGPT 订阅者提供。当推出这一模型时，OpenAI 表示新的 GPT-4Turbo 从前作中进行了多项改进，而用户们也发现这一点确实如此。

从上周四开始，更新版的 GPT-4Turbo，即 gpt-4-turbo-2024-04-09，重新夺回了 Large Model Systems Organization（LMSYS）Chatbot Arena 的榜首位置，这是一个众包的开放平台，用户可以在其中评估大型语言模型(LLM)。

在 Chatbot Arena 中，用户可以与两个 LLMs 并排聊天，比较它们的回答，而不知道每个模型的身份。这些结果被用于排名 Chatbot Arena 中的82个 LLMs，包括市场上所有最受欢迎的 LLMs，如 Gemini Pro、Claude3系列 LLMs 和 Mistral-Large-2402。

GPT-4 Turbo 击败 Claude 3，重新夺回 “最佳AI模型” 称号

截至4月13日的最新 Chatbot Arena 更新，更新版的 GPT-4Turbo 在整体、编码和英语类别中处于领先地位。这意味着不到一个月之后，Anthropic 的 Claude3Opus 在整体类别中被挤到第二名，其后是 GPT-4Turbo 的旧版本 GPT-4-1106-preview。

这些结果可能归因于 gpt-4-turbo-2024-04-09在编码、数学、逻辑推理和写作能力方面的改进，表现更高于一系列用于测试 AI 模型熟练程度的基准测试。想要自行比较 gpt-4-turbo-2024-04-09与其他 LLMs 的表现?可以访问 Chatbot Arena 网站，点击 “Arena（side-by-side）” 选项，选择要比较的模型。

值得注意的是，由于您知道侧边模式中模型的身份，您将无法进行投票。如果您想要进行投票，并让其计入排行榜，您可以使用 “Arena（battle）” 选项将随机模型进行比较。如果您想要跳过测试，直接使用 gpt-4-turbo-2024-04-09在 ChatGPT 中，需要成为 ChatGPT Plus 订阅者，费用为每月20美元。

声明：内容均采集自公开的网站等各类媒体平台，若收录的内容侵犯了您的权益，请联系邮箱，本站将第一时间处理。

{{userData.name}}已认证

GPT-4 Turbo 击败 Claude 3，重新夺回 “最佳AI模型” 称号

StableDesign：适用于室内装修设计的SD方案文字提示就可修改室内设计图

百度正式发布文心大模型4.0工具版

AI微博

AI应用

5000+AI应用！每日更新

AIAICLUB

强烈推荐！官方品牌微博

AI教程

海量教程看不完

AI基础训练营

零基础入门，带你成为AI高手

1ai抖音

1ai大神

抖音号：1ai.net

1ai大神

抖音号：1ai.net

1ai微信

每天五分钟

一年变大神

扫码关注

{{userData.name}}已认证

相关内容：

StableDesign：适用于室内装修设计的SD方案 文字提示就可修改室内设计图

百度正式发布文心大模型4.0工具版

报告称 OpenAI 采集了超一百万小时的 YouTube 视频来训练 GPT-4

重磅！GPT-4 API全面开放使用

OpenAI发布GPT-4-Turbo 正式版 可识别图片

OpenAI 宣布向 ChatGPT 付费用户开放新 GPT-4 Turbo 模型

AI应用

5000+AI应用！每日更新

AIAICLUB

强烈推荐！官方品牌微博

AI教程

海量教程看不完

AI基础训练营

零基础入门，带你成为AI高手

1ai大神

抖音号：1ai.net

1ai大神

抖音号：1ai.net

每天五分钟

一年变大神

扫码关注

StableDesign：适用于室内装修设计的SD方案文字提示就可修改室内设计图

OpenAI发布GPT-4-Turbo 正式版可识别图片