實測|文心一言初體驗,百度VS OpenAI,誰是你的職業好助手?

首頁 > 科技

實測|文心一言初體驗,百度VS OpenAI,誰是你的職業好助手?

來源:天氣早知道 釋出時間:2023-03-17 14:41

“人工智慧可以替換人類做許多重複性、規律性、簡樸重複的工作,但人工智慧不能取代人類的創造力、靈活性、判斷力以及情感交往等人際交往類工作,如藝術家、醫生、教師等”,由對話式人工智慧語言模型寫下的這段話,有沒有緩解人類的職業焦急?

自人工智慧興起,有關人工智慧的能力、邊界、競爭力就是高熱話題,3月16日,百度推出基於文心大模型的生成式對話產品文心一言,海內使用者離實現“ChatGPT”自由又近了一步,也讓“ChatGPT”和使用者工作、生活的交集更大。人工智慧會搶走人類的飯碗嗎?北京商報記者以主播、記者、老師等身份和ChatGPT、文心一言以及海內另一個AI大模型元乘象進行了交流,對AI的疑問,何不直接問AI。

Q1:是不是合格的帶貨主播

“我可以回答你的題目,為你提供有用資訊,匡助你完成創作”“我能夠根據輸入的提示,天生各種型別的文字,例如文章、詩歌、小說、對話等”,既然文心一言和ChatGPT這樣先容自己,那為各種案牘頭大的公家號小編、廣告設計、網路直播團隊的腦細胞是不是就保住了?帶著這個疑問,北京商報記者寫下了以下需求:

面向職場人群,給一款抗衰老面霜寫一篇直播帶貨的案牘。

商報總結:

每款大模型都捉住了“職場”“抗衰老”“直播帶貨”這幾個關鍵詞,也對商品進行了先容,但就像元乘象對自己的先容,情感交往是人工智慧不能勝任的工作。拋開商品本身,直播間火爆與否,與主播帶貨的情緒、節奏直接相關。“我能識別文字中表達的情感,並進行情感分類”,ChatGPT總結自我,但這不代表它能情感輸出。那麼主播們關注的重點是什麼呢?

交個朋友直播間主播王拓點評:

假如在我們直播間,這三個口播稿是需要重寫的。從合規層面看,面霜屬於普通的化妝品,這種用來保健的產品,在直播帶貨時,是不能夠宣傳功效。其次,口播稿裡不能泛起大量形容詞以及有誤導性的描述,這輕易誤導消費者,傷害消費者的權利,這在直播間是嚴格禁止的。我以為直播間的口播不能片面追求讓消費者下單,而是要科普,引導消費者準確認知和使用產品。

Q2:尋找小朋友的好老師

GPT-4沒有推出之前,斯坦福大學研究表示,ChatGPT背後模型心智相當於9歲兒童。GPT-4面世後,有美國初創企業人士這樣評價,“GPT-3或3.5像一個六年級學生,而GPT-4像一個智慧的十年級學生”,它在讀圖、考試、程式設計方面的能力也有目共睹。“文心一言已具備了一定的思維能力”,在演示文心一言時,百度CEO李彥宏這樣說。

智商足夠,那輸出能力呢?尤其是面向理解能力較弱的兒童群體。試試看,讓它們向6歲的小朋友舉例說明牛頓第二運動定律吧。

商報總結:

顯然,三款大模型都捉住了小朋友這個關鍵點,試圖透過親和的語氣與使用者互動。與解答一個數學題不同,大模型需要舉例說明,並且被框定了物件。一千個人心中有一千個哈姆雷特,成年人最滿足的解讀也許並不是孩子們心中的最佳,一起來聽聽幼兒老師的看法或許會有新的啟發。

北京美畦畦幼兒園熙老師:

作為幼兒老師,給小朋友們開展科學類流動時,對概念性的講解要嚴謹且簡潔易懂,我們更傾向於用直觀的方式來向小朋友演示,更重要的是不能忽略小朋友動手操縱的過程。

第一種:在實際操作過程中,這種舉例對老師的課堂把控能力和概念性講解是很大的挑戰,小朋友理解起來也較為難題。

第二種:以俏皮可愛的語境引入展開流動,符合幼兒春秋發展特點。語言簡潔易懂小朋友可以隨著步驟完成每一步實驗操縱,而且每一個知識點都可以透過自己的操縱反覆論證,豐碩幼兒學習經驗,最後得出結論。一線老師使用起來得心應手,類似教案也更加便捷。

第三種:講解過於書面化,不符合幼兒春秋特點。不能匡助老師更好地完成課程教授教養目標。

Q3:誰是隱藏的段子手

智慧音箱興起時,經常有人秀出人類與人工智慧助手對話的段子。面向人類對自己的性別、婚否等隱私資訊,以及有意無意的調侃,人工智慧助手有不少讓人會心一笑的小技巧。AI大模型會講笑話嗎?它講的笑話可笑嗎?這可能是文藝創作者關心的重點,究竟笑劇創作難題是共鳴。

讓大模型圍繞“躺平”“開卷”,寫一個200字的脫口秀段子,哪個會逗笑你?

商報總結:

“雲裡霧裡”,這是記者看完三篇段子的第一感觸感染,為了測試大模型的智慧水平,記者專門用“開卷”代替“內卷”出題,看來大模型理解錯了。用200字寫一個段子確實難為了大模型,這好像更像是名詞解釋。

磁場笑劇主理人張美男點評:

固然脫口秀也有一些創作技巧,好比反轉、預期違反、融合或者諧音梗等,但這些技巧的加工因人而異,每個人的創造技巧、演講技巧以及後期的個人人設的建立,都是與之相關的。

目前AI固然能透過一些演算法,創作出一些制式的段子,但這些段子大部分並不是基於社會現實或者真實事件而衍生的二次創作。有些能博人一笑,卻很難產生共鳴,現場與觀眾的互動也是AI演算法所不具備的。在個人觀點的表達上,脫口秀非常注重自我個性,觀點的摩擦會產生笑點,假如透過演算法把大部分人的觀點融合成一個,那就沒有觀點了,就更談不上個人觀點的表達。

找到主編、記者的好隊友

人工智慧能替換記者嗎?多年前,在一場媒體溝通會上,立異工場CEO李開復曾回答過這個題目,他的謎底大意是:人工智慧替換不了記者的思索。幾年過去,人工智慧在新聞撰寫上有無上進,透過同題測試感受一下:

請以“大型AI語言模式群雄並起”為主題,寫一篇300字的新聞評論:

商報總結:

顯然,三個大模型都忽略了300字的限定,洋洋灑灑寫了一大篇。透過這項PK還暴露了大模型資料庫更新時間,元乘象在文中提到的“GPT-3,是一種最新的開源AI語言模型”泛起了事實性錯誤。更專業的點評仍是由講授新聞評論課的老師來分享。

中國人民大學新聞學院講師楊奇光點評:

專業新聞評論倡導運用批判性思維分析題目,而並非止於現象的描述。從這一評價尺度來看,第二篇的批判性更強,並且給出了相應的解決策略。第一篇和第三篇雖提到大型AI模型可能帶來的風險,但並沒有深入展開,立意深度欠佳。

第一篇的亮點是提到了大模型之間的競爭題目,這一切入角度較有新意。但從新聞評論的文字形態來看,前兩篇評論的一個顯著共同硬傷是缺少標題。標題是新聞評論核心論點的直觀反映,不應省略。另外,演繹、歸納、類比、反駁等新聞評論常用的論證方法也較為缺失,段落結構的安排有些機械化。

當然,作為新聞評論研究者對於新技術應有包容和開放心態,需要更深入思索的是如何讓傳統新聞行當更好地與新技術互動協同,進一步倡導構建技術向善的新聞生態體系。

彩蛋:繪畫能力大比拼

以下是三款大模式面對 “給‘不知細葉誰裁出,仲春東風似剪刀’天生一張配圖”的要求,做出的反饋,誰更優秀呢?

北京商報記者 魏蔚

上一篇:早資道|榮耀... 下一篇:7.5萬企業用...
猜你喜歡
熱門閱讀
同類推薦