GPT-4 Turbo 擊敗 Claude 3,重新奪回 “最佳AI模型” 稱號

首頁 > 科技

GPT-4 Turbo 擊敗 Claude 3,重新奪回 “最佳AI模型” 稱號

來源:會笑的青豆 釋出時間:2024-04-20 00:36

劃重點:

⭐️ OpenAI 的最新更新使 GPT-4Turbo 在 Chatbot Arena 中超越了82個 LLM 模型

⭐️ 使用者可以在 Chatbot Arena 中比較不同模型的回答,GPT-4Turbo 表現出色

⭐️ 想要比較 GPT-4Turbo 與其他 LLMs 的表現?可以訪問 Chatbot Arena 網站進行對比

站長之家(ChinaZ.com)4月16日 訊息:OpenAI 最新推出的更新版 GPT-4Turbo 上週已經面向開發人員和付費 ChatGPT 訂閱者提供。當推出這一模型時,OpenAI 表示新的 GPT-4Turbo 從前作中進行了多項改進,而使用者們也發現這一點確實如斯。

從上週四開始,更新版的 GPT-4Turbo,即 gpt-4-turbo-2024-04-09,重新奪回了 Large Model Systems Organization(LMSYS)Chatbot Arena 的榜首位置,這是一個眾包的開放平臺,使用者可以在其中評估大型語言模型(LLM)。

在 Chatbot Arena 中,使用者可以與兩個 LLMs 並排聊天,比較它們的回答,而不知道每個模型的身份。這些結果被用於排名 Chatbot Arena 中的82個 LLMs,包括市場上所有最受歡迎的 LLMs,如 Gemini Pro、Claude3系列 LLMs 和 Mistral-Large-2402。

截至4月13日的最新 Chatbot Arena 更新,更新版的 GPT-4Turbo 在整體、編碼和英語類別中處於領先地位。這意味著不到一個月之後,Anthropic 的 Claude3Opus 在整體類別中被擠到第二名,其後是 GPT-4Turbo 的舊版本 GPT-4-1106-preview。

這些結果可能歸因於 gpt-4-turbo-2024-04-09在編碼、數學、邏輯推理和寫作能力方面的改進,表現更高於一系列用於測試 AI 模型熟練程度的基準測試。想要自行比較 gpt-4-turbo-2024-04-09與其他 LLMs 的表現?可以訪問 Chatbot Arena 網站,點選 “Arena(side-by-side)” 選項,選擇要比較的模型。

值得注意的是,由於您知道側邊模式中模型的身份,您將無法進行投票。如果您想要進行投票,並讓其計入排行榜,您可以使用 “Arena(battle)” 選項將隨機模型進行比較。如果您想要跳過測試,直接使用 gpt-4-turbo-2024-04-09在 ChatGPT 中,需要成為 ChatGPT Plus 訂閱者,費用為每月20美元。

舉報/反饋

劃重點:

⭐️ OpenAI 的最新更新使 GPT-4Turbo 在 Chatbot Arena 中超越了82個 LLM 模型

⭐️ 使用者可以在 Chatbot Arena 中比較不同模型的回答,GPT-4Turbo 表現出色

⭐️ 想要比較 GPT-4Turbo 與其他 LLMs 的表現?可以訪問 Chatbot Arena 網站進行對比

站長之家(ChinaZ.com)4月16日 訊息:OpenAI 最新推出的更新版 GPT-4Turbo 上週已經面向開發人員和付費 ChatGPT 訂閱者提供。當推出這一模型時,OpenAI 表示新的 GPT-4Turbo 從前作中進行了多項改進,而使用者們也發現這一點確實如斯。

從上週四開始,更新版的 GPT-4Turbo,即 gpt-4-turbo-2024-04-09,重新奪回了 Large Model Systems Organization(LMSYS)Chatbot Arena 的榜首位置,這是一個眾包的開放平臺,使用者可以在其中評估大型語言模型(LLM)。

在 Chatbot Arena 中,使用者可以與兩個 LLMs 並排聊天,比較它們的回答,而不知道每個模型的身份。這些結果被用於排名 Chatbot Arena 中的82個 LLMs,包括市場上所有最受歡迎的 LLMs,如 Gemini Pro、Claude3系列 LLMs 和 Mistral-Large-2402。

劃重點:

⭐️ OpenAI 的最新更新使 GPT-4Turbo 在 Chatbot Arena 中超越了82個 LLM 模型

⭐️ 使用者可以在 Chatbot Arena 中比較不同模型的回答,GPT-4Turbo 表現出色

⭐️ 想要比較 GPT-4Turbo 與其他 LLMs 的表現?可以訪問 Chatbot Arena 網站進行對比

站長之家(ChinaZ.com)4月16日 訊息:OpenAI 最新推出的更新版 GPT-4Turbo 上週已經面向開發人員和付費 ChatGPT 訂閱者提供。當推出這一模型時,OpenAI 表示新的 GPT-4Turbo 從前作中進行了多項改進,而使用者們也發現這一點確實如斯。

從上週四開始,更新版的 GPT-4Turbo,即 gpt-4-turbo-2024-04-09,重新奪回了 Large Model Systems Organization(LMSYS)Chatbot Arena 的榜首位置,這是一個眾包的開放平臺,使用者可以在其中評估大型語言模型(LLM)。

在 Chatbot Arena 中,使用者可以與兩個 LLMs 並排聊天,比較它們的回答,而不知道每個模型的身份。這些結果被用於排名 Chatbot Arena 中的82個 LLMs,包括市場上所有最受歡迎的 LLMs,如 Gemini Pro、Claude3系列 LLMs 和 Mistral-Large-2402。

上一篇:榮耀新機官宣... 下一篇:威科未來Tens...
猜你喜歡
熱門閱讀
同類推薦