0
  • 聊天消息
  • 系統(tǒng)消息
  • 評論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

自然語言處理或?qū)⒂瓉硇碌姆妒阶冞w

深度學(xué)習(xí)自然語言處理 ? 來源:李rumor ? 作者:車萬翔 ? 2022-12-08 16:59 ? 次閱讀

最近幾天被OpenAI推出的ChatGPT[1]刷屏了,其影響已經(jīng)不僅局限于自然語言處理(NLP)圈,就連投資圈也開始蠢蠢欲動了,短短幾天ChatGPT的用戶數(shù)就超過了一百萬。通過眾多網(wǎng)友以及我個人對其測試的結(jié)果看,ChatGPT的效果可以用驚艷來形容,具體結(jié)果我在此就不贅述了。不同于GPT-3剛推出時(shí)人們的反應(yīng),對ChatGPT大家發(fā)出更多的是贊嘆之詞。聊天、問答、寫作、編程等等,樣樣精通。因此也有人驚呼,“通用人工智能(AGI)即將到來”、“Google等傳統(tǒng)搜索引擎即將被取代”,所以也對傳說中即將發(fā)布的GPT-4更加期待。

從技術(shù)角度講,ChatGPT還是基于大規(guī)模預(yù)訓(xùn)練語言模型(GPT-3.5)強(qiáng)大的語言理解和生成的能力,并通過在人工標(biāo)注和反饋的大規(guī)模數(shù)據(jù)上進(jìn)行學(xué)習(xí),從而讓預(yù)訓(xùn)練語言模型能夠更好地理解人類的問題并給出更好的回復(fù)。這一點(diǎn)上和OpenAI于今年3月份推出的InstructGPT[2]是一致的,即通過引入人工標(biāo)注和反饋,解決了自然語言生成結(jié)果不易評價(jià)的問題,從而就可以像玩兒游戲一樣,利用強(qiáng)化學(xué)習(xí)技術(shù),通過嘗試生成不同的結(jié)果并對結(jié)果進(jìn)行評分,然后鼓勵評分高的策略、懲罰評分低的策略,最終獲得更好的模型。

不過說實(shí)話,我當(dāng)時(shí)并不看好這一技術(shù)路線,因?yàn)檫@仍然需要大量的人工勞動,本質(zhì)上還是一種“人工”智能。不過ChatGPT通過持續(xù)投入大量的人力,把這條路走通了,從而更進(jìn)一步驗(yàn)證了那句話,“有多少人工,就有多少智能”。

不過,需要注意的是,ChatGPT以及一系列超大規(guī)模預(yù)訓(xùn)練語言模型的成功將為自然語言處理帶來新的范式變遷,即從以BERT為代表的預(yù)訓(xùn)練+精調(diào)(Fine-tuning)范式,轉(zhuǎn)換為以GPT-3為代表的預(yù)訓(xùn)練+提示(Prompting)的范式[3]。所謂提示,指的是通過構(gòu)造自然語言提示符(Prompt),將下游任務(wù)轉(zhuǎn)化為預(yù)訓(xùn)練階段的語言模型任務(wù)。例如,若想識別句子“我喜歡這部電影?!钡那楦袃A向性,可以在其后拼接提示符“它很 ”。如果預(yù)訓(xùn)練模型預(yù)測空格處為“精彩”,則句子大概率為褒義。這樣做的好處是無需精調(diào)整個預(yù)訓(xùn)練模型,就可以調(diào)動模型內(nèi)部的知識,完成“任意”的自然語言處理任務(wù)。當(dāng)然,在ChatGPT出現(xiàn)之前,這種范式轉(zhuǎn)變的趨勢并不明顯,主要有兩個原因:

第一,GPT-3級別的大模型基本都掌握在大公司手里,因此學(xué)術(shù)界在進(jìn)行預(yù)訓(xùn)練+提示的研究時(shí)基本都使用規(guī)模相對比較小的預(yù)訓(xùn)練模型。由于規(guī)模規(guī)模不夠大,因此預(yù)訓(xùn)練+提示的效果并不比預(yù)訓(xùn)練+精調(diào)的效果好。而只有當(dāng)模型的規(guī)模足夠大后,才會涌現(xiàn)(Emerge)出“智能”[4]。最終,導(dǎo)致之前很多在小規(guī)模模型上得出的結(jié)論,在大規(guī)模模型下都未必適用了。

第二,如果僅利用預(yù)訓(xùn)練+提示的方法,由于預(yù)訓(xùn)練的語言模型任務(wù)和下游任務(wù)之間差異較大,導(dǎo)致這種方法除了擅長續(xù)寫文本這種預(yù)訓(xùn)練任務(wù)外,對其他任務(wù)完成得并不好。因此,為了應(yīng)對更多的任務(wù),需要在下游任務(wù)上繼續(xù)預(yù)訓(xùn)練(也可以叫預(yù)精調(diào)),而且現(xiàn)在的趨勢是在眾多的下游任務(wù)上預(yù)精調(diào)大模型,以應(yīng)對多種、甚至未曾見過的新任務(wù)[5]。所以更準(zhǔn)確地說,預(yù)訓(xùn)練+預(yù)精調(diào)+提示將成為自然語言處理的新范式。

不同于傳統(tǒng)預(yù)訓(xùn)練+精調(diào)范式,預(yù)訓(xùn)練+預(yù)精調(diào)+提示范式將過去一個自然語言處理模型擅長處理一個具體任務(wù)的方式,轉(zhuǎn)換為了用一個模型處理多個任務(wù),甚至未曾見過的通用任務(wù)的方式。所以從這個角度來講,通用人工智能也許真的即將到來了。這似乎也和我?guī)啄昵暗念A(yù)測相吻合,我當(dāng)時(shí)曾預(yù)測,“結(jié)合自然語言處理歷次范式變遷的規(guī)律(圖1),2018年預(yù)訓(xùn)練+精調(diào)的范式出現(xiàn)之后5年,即2023年自然語言處理也許將迎來新的范式變遷”。

30d6543e-76c4-11ed-8abf-dac502259ad0.jpg

那么,接下來如何進(jìn)一步提升預(yù)訓(xùn)練+預(yù)精調(diào)+提示新范式的能力,并在實(shí)際應(yīng)用中將其落地呢?

首先,顯式地利用人工標(biāo)注和反饋仍然費(fèi)時(shí)費(fèi)力,我們應(yīng)該設(shè)法更自然地獲取并利用人類的反饋。也就是在實(shí)際應(yīng)用場景中,獲取真實(shí)用戶的自然反饋,如其回復(fù)的語句、所做的行為等,并利用這些反饋信息提升系統(tǒng)的性能,我們將這種方式稱為交互式自然語言處理。不過用戶的交互式反饋相對稀疏,并且有些用戶會做出惡意的反饋,如何克服稀疏性以及避免惡意性反饋都將是亟待解決的問題。

其次,目前該范式生成的自然語言文本具有非常好的流暢性,但是經(jīng)常會出現(xiàn)事實(shí)性錯誤,也就是會一本正經(jīng)地胡說八道。當(dāng)然,使用上面的交互式自然語言處理方法可以一定程度上解決此類問題,不過對于用戶都不知道答案的問題,他們是無法對結(jié)果進(jìn)行反饋的。此時(shí)又回到了可解釋性差,這一深度學(xué)習(xí)模型的老問題上。如果能夠像寫論文時(shí)插入?yún)⒖嘉墨I(xiàn)一樣,在生成的結(jié)果中插入相關(guān)信息的出處,則會大大提高結(jié)果的可解釋性。

最后,該范式依賴超大規(guī)模預(yù)訓(xùn)練語言模型,然而這些模型目前只掌握在少數(shù)的大公司手中,即便有個別開源的大模型,由于其過于龐大,小型公司或研究組也無法下載并使用它們。所以,在線調(diào)用是目前使用這些模型最主要的模式。在該模式下,如何針對不同用戶面對的不同任務(wù),使用用戶私有的數(shù)據(jù)對模型進(jìn)行進(jìn)一步預(yù)精調(diào),并且不對公有的大模型造成影響,成為該范式實(shí)際應(yīng)用落地所迫切需要解決的問題。此外,為了提高系統(tǒng)的運(yùn)行速度,如何通過在線的大模型獲得離線的小模型,并且讓離線小模型保持大模型在某些任務(wù)上的能力,也成為模型能實(shí)際應(yīng)用的一種解決方案。

審核編輯:郭婷

聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問題,請聯(lián)系本站處理。 舉報(bào)投訴
  • 人工智能
    +關(guān)注

    關(guān)注

    1789

    文章

    46338

    瀏覽量

    236498
  • nlp
    nlp
    +關(guān)注

    關(guān)注

    1

    文章

    483

    瀏覽量

    21971

原文標(biāo)題:哈工大車萬翔:自然語言處理范式正在變遷

文章出處:【微信號:zenRRan,微信公眾號:深度學(xué)習(xí)自然語言處理】歡迎添加關(guān)注!文章轉(zhuǎn)載請注明出處。

收藏 人收藏

    評論

    相關(guān)推薦

    圖像識別技術(shù)包括自然語言處理

    圖像識別技術(shù)與自然語言處理是人工智能領(lǐng)域的兩個重要分支,它們在很多方面有著密切的聯(lián)系,但也存在一些區(qū)別。 一、圖像識別技術(shù)與自然語言處理的關(guān)系 1.1 圖像識別技術(shù)的定義 圖像識別技術(shù)
    的頭像 發(fā)表于 07-16 10:54 ?501次閱讀

    自然語言處理前饋網(wǎng)絡(luò)綜述

    自然語言處理(NLP)前饋網(wǎng)絡(luò)是人工智能和語言學(xué)領(lǐng)域的一個重要交叉學(xué)科,旨在通過計(jì)算機(jī)模型理解和處理人類語言。前饋神經(jīng)網(wǎng)絡(luò)(Feedforw
    的頭像 發(fā)表于 07-12 10:10 ?229次閱讀

    Transformer架構(gòu)在自然語言處理中的應(yīng)用

    隨著人工智能技術(shù)的飛速發(fā)展,自然語言處理(NLP)領(lǐng)域取得了顯著的進(jìn)步。其中,Transformer架構(gòu)的提出,為NLP領(lǐng)域帶來了革命性的變革。本文深入探討Transformer架構(gòu)的核心思想、組成部分以及在
    的頭像 發(fā)表于 07-09 11:42 ?608次閱讀

    nlp自然語言處理的應(yīng)用有哪些

    自然語言處理(Natural Language Processing,簡稱NLP)是人工智能領(lǐng)域的一個分支,它致力于使計(jì)算機(jī)能夠理解和生成自然語言。隨著技術(shù)的發(fā)展,NLP已經(jīng)在許多領(lǐng)域得到了廣泛
    的頭像 發(fā)表于 07-05 09:55 ?2221次閱讀

    用于自然語言處理的神經(jīng)網(wǎng)絡(luò)有哪些

    取得了顯著進(jìn)展,成為處理自然語言任務(wù)的主要工具。本文詳細(xì)介紹幾種常用于NLP的神經(jīng)網(wǎng)絡(luò)模型,包括遞歸神經(jīng)網(wǎng)絡(luò)(RNN)、長短時(shí)記憶網(wǎng)絡(luò)(LSTM)、卷積神經(jīng)網(wǎng)絡(luò)(CNN)、變換器(Transformer)以及預(yù)訓(xùn)練模型如BER
    的頭像 發(fā)表于 07-03 16:17 ?565次閱讀

    自然語言處理技術(shù)有哪些

    自然語言處理(Natural Language Processing,簡稱NLP)是人工智能領(lǐng)域的一個分支,它致力于使計(jì)算機(jī)能夠理解、解釋和生成人類語言。自然語言
    的頭像 發(fā)表于 07-03 14:30 ?751次閱讀

    自然語言處理模式的優(yōu)點(diǎn)

    自然語言處理(Natural Language Processing,簡稱NLP)是人工智能領(lǐng)域的一個重要分支,它致力于使計(jì)算機(jī)能夠理解、生成和處理人類語言。隨著技術(shù)的發(fā)展,
    的頭像 發(fā)表于 07-03 14:24 ?538次閱讀

    自然語言處理技術(shù)的核心是什么

    自然語言處理(Natural Language Processing,簡稱NLP)是人工智能領(lǐng)域的一個重要分支,其核心目標(biāo)是使計(jì)算機(jī)能夠理解、生成和處理人類語言。NLP技術(shù)的發(fā)展已經(jīng)取
    的頭像 發(fā)表于 07-03 14:20 ?413次閱讀

    自然語言處理是什么技術(shù)的一種應(yīng)用

    自然語言處理(Natural Language Processing,簡稱NLP)是人工智能和語言學(xué)領(lǐng)域的一個分支,它涉及到使用計(jì)算機(jī)技術(shù)來處理、分析和生成
    的頭像 發(fā)表于 07-03 14:18 ?439次閱讀

    自然語言處理包括哪些內(nèi)容

    ,從而實(shí)現(xiàn)人機(jī)之間的自然交流。本文詳細(xì)介紹NLP的主要內(nèi)容,包括基本概念、關(guān)鍵技術(shù)、應(yīng)用領(lǐng)域等。 一、自然語言處理的基本概念 自然語言
    的頭像 發(fā)表于 07-03 14:15 ?604次閱讀

    自然語言列舉法描述法各自的特點(diǎn)

    自然語言處理(Natural Language Processing,簡稱NLP)是人工智能領(lǐng)域的一個重要分支,它涉及到計(jì)算機(jī)與人類語言之間的交互。自然語言
    的頭像 發(fā)表于 07-03 14:13 ?840次閱讀

    自然語言處理屬于人工智能的哪個領(lǐng)域

    自然語言處理(Natural Language Processing,簡稱NLP)是人工智能(Artificial Intelligence,簡稱AI)領(lǐng)域的一個重要分支。它涉及到計(jì)算機(jī)與人類語言
    的頭像 發(fā)表于 07-03 14:09 ?905次閱讀

    什么是自然語言處理 (NLP)

    自然語言處理(Natural Language Processing, NLP)是人工智能領(lǐng)域中的一個重要分支,它專注于構(gòu)建能夠理解和生成人類語言的計(jì)算機(jī)系統(tǒng)。NLP的目標(biāo)是使計(jì)算機(jī)能夠像人類一樣
    的頭像 發(fā)表于 07-02 18:16 ?699次閱讀

    自然語言處理技術(shù)的原理的應(yīng)用

    自然語言處理(Natural Language Processing, NLP)作為人工智能(AI)領(lǐng)域的一個重要分支,旨在使計(jì)算機(jī)能夠理解和處理人類自然語言。隨著互聯(lián)網(wǎng)的普及和大數(shù)據(jù)
    的頭像 發(fā)表于 07-02 12:50 ?324次閱讀

    神經(jīng)網(wǎng)絡(luò)在自然語言處理中的應(yīng)用

    自然語言處理(NLP)是人工智能領(lǐng)域中的一個重要分支,它研究的是如何使計(jì)算機(jī)能夠理解和生成人類自然語言。隨著人工智能技術(shù)的飛速發(fā)展,神經(jīng)網(wǎng)絡(luò)在自然語言
    的頭像 發(fā)表于 07-01 14:09 ?356次閱讀