
【CSDN 編者按】OpenAI 總裁格雷格・布羅克曼:GPT-4 並不完美但絕對與眾不同。
原文連結:https://techcrunch.com/2023/03/15/interview-with-openais-greg-brockman-gpt-4-isnt-perfect-but-neither-are-you/
未經允許,禁止轉載!
收拾整頓 | 王子彧
出品 | CSDN(ID:CSDNnews)3月15日,繼 ChatGPT 展現了驚人的實力之後,OpenAI 又扔下了一顆核彈:備受期待的史上最強人工智慧大模型 GPT-4 釋出了。
據 TechCrunch 訊息,OpenAI 聯合創始人兼總裁格雷格・布羅克曼在接受記者凱爾·威格斯採訪時表示,GPT-4 並不完美但絕對與眾不同,並且他還在採訪中透露,OpenAI 正在測試 GPT-4 高階版本,是普通 GPT-4 儲存內容能力的 5 倍。本文對這篇採訪進行了編譯,以饗讀者。
關鍵改進:多模態能力
GPT-4 在其前身 GPT-3 的基礎上,對很多方面做了關鍵性的改進。例如提供了更多真實的宣告,並允許開發者更容易設計其風格和行為。同時,GPT-4 也是多模態的,它可以可以接受影象作為輸入並生成標題、分類和分析。
但 GPT-4 也有侷限性。和 GPT-3 一樣,該模型對事實產生了 "幻覺",並出現了基本的推理錯誤。OpenAI 在自己的部落格上舉了個例子, GPT-4 將“貓王”埃爾維斯・普雷斯利(Elvis Presley)描述為 "一個演員的兒子",但事實是他的父母都不是演員。
當被問及如何比較 GPT-4 和 GPT-3 時,格雷格・布羅克曼說了一個詞:與眾不同。他解釋到:“儘管 GPT-4 還存在很多問題和錯誤,但絕對與眾不同,你可以看到其在微積分或法律等技能方面的提升。雖然它曾在某些領域表現很糟糕,但現在已經達到超越常人的水準。”
測試結果驗證了格雷格・布羅克曼的觀點。在高考微積分考試中,GPT-4 得了 4 分, GPT-3 得了 1 分,而介於 GPT-3 和 GPT-4 之間的中間模型 GPT-3.5,得了 4 分。
在分析 GPT-4 的能力時,OpenAI 還讓該模型參加了統一律師考試、法學院入學考試(LSAT)、研究生入學考試(GRE)的定量、口頭推理、分析寫作考試以及和各種 AP 科目考試等測試。結果顯示,GPT-4 在大多數這些專業和學術考試中表現與人類水平相當。這意味著,如果 GPT-4 是一個僅憑應試能力來判斷的人,它可以進入法學院,而且很可能也能進入許多大學。


不僅如此,GPT-4 更受人關注的是上面提到的多模態。GPT-3 和 GPT-3.5 只能接受文字提示(例如 "寫一篇關於長頸鹿的文章"),而 GPT-4 可以同時接受圖片和文字的提示來完成一些動作(例如識別在塞倫蓋蒂拍攝的長頸鹿影象,並給出基本的內容描述。)
這是因為 GPT-4 是在影象和文字資料上訓練的,而它的前身只在文字上訓練。OpenAI 說,訓練資料來自 "各種合法授權的、公開可用的資料來源,其中可能包括公開可用的個人資訊",但當被問具體細節時,格雷格・布羅克曼避而不談。(訓練資料曾使 OpenAI 陷入法律糾紛)。
超強優勢:影象理解能力
GPT-4 有超強的影象理解能力。例如,輸入提示“這張圖片有什麼好笑的?GPT-4 會將整張圖片分解,並正確地解釋了這個笑話的笑點。
目前,只有一個合作伙伴可以使用 GPT-4 的影象分析功能,一個名為 Be My Eyes 的視力障礙者的輔助應用程式。布羅克曼說,在 OpenAI 評估風險和利弊的過程中,無論何時,更廣泛的推廣都將是“緩慢而有意的”。他還認為,"有一些政策問題我們需要解決,如面部識別和如何對待人的影象。我們需要弄清楚危險區在哪裡,紅線在哪裡,再隨著時間的推移找到答案。"
OpenAI 在其文字到影象轉換系統 Dall-E 2 上也遇到了類似倫理困境。在最初禁用該功能後,OpenAI 允許客戶上傳人臉,用 AI 驅動的影象生成系統對其進行編輯。當時,OpenAI 聲稱,其安全系統的升級使面部編輯功能成為可能,因為它將深度造假以及試圖建立性、政治和暴力內容的潛在危害降到最低。
另一個長期問題是防止 GPT-4 在無意中被用於可能造成傷害的方式使用。在該模型釋出幾小時後,以色列網路安全初創公司 Adversa AI 釋出了一篇部落格,演示了繞過 OpenAI 的內容過濾器並讓 GPT-4 生成釣魚電子郵件、對同性戀者的攻擊性描述以及其他令人反感文字的方法。
在語言模型領域,這並不罕見。Facebook 母公司 Meta 的聊天機器人 BlenderBot 和 OpenAI 的 ChatGPT 也曾被誘惑輸出不恰當的內容,甚至透露了其內部工作的敏感細節。但包括記者在內的許多人都希望,GPT-4 可能會在這方面帶來重大改進。
當被問及 GPT-4 的穩健性時,布羅克曼強調,該模型已經透過六個月的安全培訓。在內部測試中,與 GPT-3.5 相比,它對 OpenAI 的使用政策不允許的內容請求的回應率降低了 82%,對 "事實 "的回應率提高了 40% 。
布羅克曼說:"我們花了很多時間試圖瞭解 GPT-4 的能力,我們不斷地進行更新,包括不斷改進,這樣模型就更有擴充套件性,以達到人們希望它擁有的任何個性或模式。"
不足之處
坦率地說,早期的現實測試結果並不是那麼讓人滿意。除了 Adversa AI 測試之外,微軟的聊天機器人 Bing Chat 也被證明非常容易受到越獄影響。使用精心設計的輸入,使用者能夠讓該聊天機器人表達愛意,發出威脅傷害,為大屠殺辯護和編造陰謀論。
布羅克曼並不否認 GPT-4 在這方面的不足,但他強調了該模型的緩解性轉向工具,包括被稱為“系統”訊息的 API 級功能。系統訊息本質上是為 GPT-4 的互動設定基調並建立界限的指令。例如,一條系統訊息可能是這樣寫的:“你是一位總是以蘇格拉底風格回答問題的導師。你永遠不會給學生答案,而是總是試著提出正確的問題,幫助他們學會獨立思考。”
我們的想法是,系統訊息充當護欄,防止 GPT-4 偏離軌道。布羅克曼說:“真正弄清楚 GPT-4 的語氣、風格和本質一直是我們關注的焦點。我認為我們開始更多地瞭解如何進行工程設計,瞭解如何擁有一個可重複的過程,讓你得到對人們真正有用的可預測結果。”
布羅克曼還提到了 Evals,這是 OpenAI 最新的開源軟體框架,用於評估其 AI 模型的效能,這是 OpenAI 致力於“增強”其模型的一個標誌。Evals 允許使用者開發和執行評估 GPT-4 等模型 的基準測試,同時檢查其效能,這是一種眾包的模型測試方法。
布羅克曼說:“透過 Evals,我們可以更好地看到使用者關心的用例,並可以對其進行測試。我們之所以開源這個框架原因之一是我們不再每隔三個月釋出一個新模型以不斷改進。你不會製造你不能測量的東西,對吧?當我們推出新版模型,我們至少可以知道發生了哪些變化。”
布羅克曼還被問道,OpenAI 是否會補償人們用 Evals 測試其模型?他不肯承諾,但他確實指出,在有限的時間內,OpenAI 允許選定的 Eevals 使用者提前訪問 GPT-4 API。
關於未來:GPT-4 的另一個版本
布羅克曼的談話還談到了 GPT-4 的上下文視窗,指的是模型在生成其他文字之前可以考慮的文字。OpenAI 正在測試 GPT-4 的另一個版本,它可以 "記住 "大約 50 頁的內容,是普通的 GPT-4 所能容納內容的 5 倍,是 GPT-3 的八倍。
布羅克曼認為,擴大的上下文視窗會帶來新的、以前沒有探索過的應用,特別是在企業中。他設想了一個為公司打造的 AI 聊天機器人,利用來自不同來源的各部門的員工的背景和知識,以一種非常明智但具有對話性的方式回答問題。
這不是一個新概念。但布羅克曼提出的理由是,GPT-4 的答案將比今天的聊天機器人和搜尋引擎的答案有用得多。他說:“以前,模型根本不知道你是誰,你對什麼感興趣等。而有了更大的上下文視窗肯定會讓它的能力變強,從而更好的為人們提供服務支援。”


【CSDN 編者按】OpenAI 總裁格雷格・布羅克曼:GPT-4 並不完美但絕對與眾不同。
原文連結:https://techcrunch.com/2023/03/15/interview-with-openais-greg-brockman-gpt-4-isnt-perfect-but-neither-are-you/
未經允許,禁止轉載!
收拾整頓 | 王子彧
出品 | CSDN(ID:CSDNnews)3月15日,繼 ChatGPT 展現了驚人的實力之後,OpenAI 又扔下了一顆核彈:備受期待的史上最強人工智慧大模型 GPT-4 釋出了。
據 TechCrunch 訊息,OpenAI 聯合創始人兼總裁格雷格・布羅克曼在接受記者凱爾·威格斯採訪時表示,GPT-4 並不完美但絕對與眾不同,並且他還在採訪中透露,OpenAI 正在測試 GPT-4 高階版本,是普通 GPT-4 儲存內容能力的 5 倍。本文對這篇採訪進行了編譯,以饗讀者。
關鍵改進:多模態能力
GPT-4 在其前身 GPT-3 的基礎上,對很多方面做了關鍵性的改進。例如提供了更多真實的宣告,並允許開發者更容易設計其風格和行為。同時,GPT-4 也是多模態的,它可以可以接受影象作為輸入並生成標題、分類和分析。
但 GPT-4 也有侷限性。和 GPT-3 一樣,該模型對事實產生了 "幻覺",並出現了基本的推理錯誤。OpenAI 在自己的部落格上舉了個例子, GPT-4 將“貓王”埃爾維斯・普雷斯利(Elvis Presley)描述為 "一個演員的兒子",但事實是他的父母都不是演員。
當被問及如何比較 GPT-4 和 GPT-3 時,格雷格・布羅克曼說了一個詞:與眾不同。他解釋到:“儘管 GPT-4 還存在很多問題和錯誤,但絕對與眾不同,你可以看到其在微積分或法律等技能方面的提升。雖然它曾在某些領域表現很糟糕,但現在已經達到超越常人的水準。”
測試結果驗證了格雷格・布羅克曼的觀點。在高考微積分考試中,GPT-4 得了 4 分, GPT-3 得了 1 分,而介於 GPT-3 和 GPT-4 之間的中間模型 GPT-3.5,得了 4 分。
在分析 GPT-4 的能力時,OpenAI 還讓該模型參加了統一律師考試、法學院入學考試(LSAT)、研究生入學考試(GRE)的定量、口頭推理、分析寫作考試以及和各種 AP 科目考試等測試。結果顯示,GPT-4 在大多數這些專業和學術考試中表現與人類水平相當。這意味著,如果 GPT-4 是一個僅憑應試能力來判斷的人,它可以進入法學院,而且很可能也能進入許多大學。



【CSDN 編者按】OpenAI 總裁格雷格・布羅克曼:GPT-4 並不完美但絕對與眾不同。
原文連結:https://techcrunch.com/2023/03/15/interview-with-openais-greg-brockman-gpt-4-isnt-perfect-but-neither-are-you/
未經允許,禁止轉載!
收拾整頓 | 王子彧
出品 | CSDN(ID:CSDNnews)3月15日,繼 ChatGPT 展現了驚人的實力之後,OpenAI 又扔下了一顆核彈:備受期待的史上最強人工智慧大模型 GPT-4 釋出了。
據 TechCrunch 訊息,OpenAI 聯合創始人兼總裁格雷格・布羅克曼在接受記者凱爾·威格斯採訪時表示,GPT-4 並不完美但絕對與眾不同,並且他還在採訪中透露,OpenAI 正在測試 GPT-4 高階版本,是普通 GPT-4 儲存內容能力的 5 倍。本文對這篇採訪進行了編譯,以饗讀者。
關鍵改進:多模態能力
GPT-4 在其前身 GPT-3 的基礎上,對很多方面做了關鍵性的改進。例如提供了更多真實的宣告,並允許開發者更容易設計其風格和行為。同時,GPT-4 也是多模態的,它可以可以接受影象作為輸入並生成標題、分類和分析。
但 GPT-4 也有侷限性。和 GPT-3 一樣,該模型對事實產生了 "幻覺",並出現了基本的推理錯誤。OpenAI 在自己的部落格上舉了個例子, GPT-4 將“貓王”埃爾維斯・普雷斯利(Elvis Presley)描述為 "一個演員的兒子",但事實是他的父母都不是演員。
當被問及如何比較 GPT-4 和 GPT-3 時,格雷格・布羅克曼說了一個詞:與眾不同。他解釋到:“儘管 GPT-4 還存在很多問題和錯誤,但絕對與眾不同,你可以看到其在微積分或法律等技能方面的提升。雖然它曾在某些領域表現很糟糕,但現在已經達到超越常人的水準。”
測試結果驗證了格雷格・布羅克曼的觀點。在高考微積分考試中,GPT-4 得了 4 分, GPT-3 得了 1 分,而介於 GPT-3 和 GPT-4 之間的中間模型 GPT-3.5,得了 4 分。
在分析 GPT-4 的能力時,OpenAI 還讓該模型參加了統一律師考試、法學院入學考試(LSAT)、研究生入學考試(GRE)的定量、口頭推理、分析寫作考試以及和各種 AP 科目考試等測試。結果顯示,GPT-4 在大多數這些專業和學術考試中表現與人類水平相當。這意味著,如果 GPT-4 是一個僅憑應試能力來判斷的人,它可以進入法學院,而且很可能也能進入許多大學。



【CSDN 編者按】OpenAI 總裁格雷格・布羅克曼:GPT-4 並不完美但絕對與眾不同。
原文連結:https://techcrunch.com/2023/03/15/interview-with-openais-greg-brockman-gpt-4-isnt-perfect-but-neither-are-you/
未經允許,禁止轉載!
收拾整頓 | 王子彧
出品 | CSDN(ID:CSDNnews)3月15日,繼 ChatGPT 展現了驚人的實力之後,OpenAI 又扔下了一顆核彈:備受期待的史上最強人工智慧大模型 GPT-4 釋出了。
據 TechCrunch 訊息,OpenAI 聯合創始人兼總裁格雷格・布羅克曼在接受記者凱爾·威格斯採訪時表示,GPT-4 並不完美但絕對與眾不同,並且他還在採訪中透露,OpenAI 正在測試 GPT-4 高階版本,是普通 GPT-4 儲存內容能力的 5 倍。本文對這篇採訪進行了編譯,以饗讀者。
關鍵改進:多模態能力
GPT-4 在其前身 GPT-3 的基礎上,對很多方面做了關鍵性的改進。例如提供了更多真實的宣告,並允許開發者更容易設計其風格和行為。同時,GPT-4 也是多模態的,它可以可以接受影象作為輸入並生成標題、分類和分析。
但 GPT-4 也有侷限性。和 GPT-3 一樣,該模型對事實產生了 "幻覺",並出現了基本的推理錯誤。OpenAI 在自己的部落格上舉了個例子, GPT-4 將“貓王”埃爾維斯・普雷斯利(Elvis Presley)描述為 "一個演員的兒子",但事實是他的父母都不是演員。
當被問及如何比較 GPT-4 和 GPT-3 時,格雷格・布羅克曼說了一個詞:與眾不同。他解釋到:“儘管 GPT-4 還存在很多問題和錯誤,但絕對與眾不同,你可以看到其在微積分或法律等技能方面的提升。雖然它曾在某些領域表現很糟糕,但現在已經達到超越常人的水準。”
測試結果驗證了格雷格・布羅克曼的觀點。在高考微積分考試中,GPT-4 得了 4 分, GPT-3 得了 1 分,而介於 GPT-3 和 GPT-4 之間的中間模型 GPT-3.5,得了 4 分。
在分析 GPT-4 的能力時,OpenAI 還讓該模型參加了統一律師考試、法學院入學考試(LSAT)、研究生入學考試(GRE)的定量、口頭推理、分析寫作考試以及和各種 AP 科目考試等測試。結果顯示,GPT-4 在大多數這些專業和學術考試中表現與人類水平相當。這意味著,如果 GPT-4 是一個僅憑應試能力來判斷的人,它可以進入法學院,而且很可能也能進入許多大學。

