日韩性视频-久久久蜜桃-www中文字幕-在线中文字幕av-亚洲欧美一区二区三区四区-撸久久-香蕉视频一区-久久无码精品丰满人妻-国产高潮av-激情福利社-日韩av网址大全-国产精品久久999-日本五十路在线-性欧美在线-久久99精品波多结衣一区-男女午夜免费视频-黑人极品ⅴideos精品欧美棵-人人妻人人澡人人爽精品欧美一区-日韩一区在线看-欧美a级在线免费观看

歡迎訪問 生活随笔!

生活随笔

當前位置: 首頁 >

【自然语言处理】自然语言处理(NLP)知识结构总结

發布時間:2025/3/21 22 豆豆
生活随笔 收集整理的這篇文章主要介紹了 【自然语言处理】自然语言处理(NLP)知识结构总结 小編覺得挺不錯的,現在分享給大家,幫大家做個參考.

感謝原創博主,轉自:https://blog.csdn.net/meihao5/article/details/79592667

自然語言處理知識太龐大了,網上也都是一些零零散散的知識,比如單獨講某些模型,也沒有來龍去脈,學習起來較為困難,于是我自己總結了一份知識體系結構,不足之處,歡迎指正。內容來源主要參考黃志洪老師的自然語言處理課程。主要參考書為宗成慶老師的《統計自然語言處理》,雖然很多內容寫的不清楚,但好像中文NLP書籍就這一本全一些,如果想看好的英文資料,可以到我的GitHub上下載: ?http://github.com/lovesoft5/ml

? 下面直接開始正文:

? ? 一、自然語言處理概述

? ? ? ? ? ? ? ?1)自然語言處理:利用計算機為工具,對書面實行或者口頭形式進行各種各樣的處理和加工的技術,是研究人與人交際中以及人與計算機交際中的演員問題的一門學科,是人工智能的主要內容。
? ? ? ? ? ? ? 2)自然語言處理是研究語言能力和語言應用的模型,建立計算機(算法)框架來實現這樣的語言模型,并完善、評測、最終用于設計各種實用系統。
? ? ? ? ? ? ? 3)研究問題(主要):
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?信息檢索
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?機器翻譯
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?文檔分類
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?問答系統
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?信息過濾
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?自動文摘
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?信息抽取
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?文本挖掘
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?輿情分析
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?機器寫作
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?語音識別
研究模式:自然語言場景問題,數學算法,算法如何應用到解決這些問題,預料訓練,相關實際應用? ? ? ? ? ? ? ?自然語言的困難:
? ? ? ? ? ? ? ? ? ? ? ? ? ?場景的困難:語言的多樣性、多變性、歧義性
? ? ? ? ? ? ? ? ? ? ? ? ? ?學習的困難:艱難的數學模型(hmm,crf,EM,深度學習等)
? ? ? ? ? ? ? ? ? ? ? ? ? ?語料的困難:什么的語料?語料的作用?如何獲取語料?

? ? 二、形式語言與自動機?

? ? ? ? ? ? ? ?語言:按照一定規律構成的句子或者字符串的有限或者無限的集合。

? ? ? ? ? ? ? ? 描述語言的三種途徑:

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 窮舉法
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 文法(產生式系統)描述
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 自動機

? ? ? ? ? ? ? ?自然語言不是人為設計而是自然進化的,形式語言比如:運算符號、化學分子式、編程語言

? ? ? ? ? ? ? ?形式語言理論朱啊喲研究的是內部結構模式這類語言的純粹的語法領域,從語言學而來,作為一種理解自然語言的句法規律,在計算機科學中,形式語言通常作為定義編程和語法結構的基礎

? ? ? ? ? ? ? ?形式語言與自動機基礎知識:

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?集合論
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?圖論
? ? ? ? ? ? ? ?自動機的應用:

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 1,單詞自動查錯糾正

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 2,詞性消歧(什么是詞性?什么的詞性標注?為什么需要標注?如何標注?)

? ? ? ? ? ? ? 形式語言的缺陷:

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 1、對于像漢語,英語這樣的大型自然語言系統,難以構造精確的文法

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 2、不符合人類學習語言的習慣

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 3、有些句子語法正確,但在語義上卻不可能,形式語言無法排出這些句子

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 4、解決方向:基于大量語料,采用統計學手段建立模型 ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?

? ? 三、語言模型

? ? ? ? ? ?1)語言模型(重要):通過語料計算某個句子出現的概率(概率表示),常用的有2-元模型,3-元模型
? ? ? ? ? ?2)語言模型應用:

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?語音識別歧義消除例如,給定拼音串:ta shi yan yan jiu saun fa de

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?可能的漢字串:踏實煙酒算法的 ? 他是研究酸法的 ? ? ?他是研究算法的,顯然,最后一句才符合。

? ? ? ? ? 3)語言模型的啟示:

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 1、開啟自然語言處理的統計方法

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 2、統計方法的一般步驟: ? ? ? ? ? ? ??

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?收集大量語料
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?對語料進行統計分析,得出知識
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?針對場景建立算法模型
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?解釋和應用結果
4) 語言模型性能評價,包括評價目標,評價的難點,常用指標(交叉熵,困惑度)

? ? ? ? ? 5)數據平滑:

? ? ? ? ? ? ? ? ? ? ? ? ?數據平滑的概念,為什么需要平滑

? ? ? ? ? ? ? ? ? ? ? ? ?平滑的方法,加一法,加法平滑法,古德-圖靈法,J-M法,Katz平滑法等

? ? ? ? 6)語言模型的缺陷:

? ? ? ? ? ? ? ? ? ? ? ? 語料來自不同的領域,而語言模型對文本類型、主題等十分敏感

? ? ? ? ? ? ? ? ? ? ? ? ?n與相鄰的n-1個詞相關,假設不是很成立。


? ?四、概率圖模型,生成模型與判別模型,貝葉斯網絡,馬爾科夫鏈與隱馬爾科夫模型(HMM)

? ? ? ? ? ??1)概率圖模型概述(什么的概率圖模型,參考清華大學教材《概率圖模型》)

? ? ? ? ? ?2)馬爾科夫過程(定義,理解)

3)隱馬爾科夫過程(定義,理解)

? ? ? ? ? ? ? HMM的三個基本問題(定義,解法,應用)

? ? ? ? ? ? ? ? ?注:第一個問題,涉及最大似然估計法,第二個問題涉及EM算法,第三個問題涉及維特比算法,內容很多,要重點理解,(參考書李航《統計學習方法》,網上博客,筆者github)

? ? ? ?

? ? 五、馬爾科夫網,最大熵模型,條件隨機場(CRF)

? ? ? ? ? ? ? ?1)HMM的三個基本問題的參數估計與計算

? ? ? ? ? ? ? ?2)什么是熵

? ? ? ? ? ? ? ?3)EM算法(應用十分廣泛,好好理解)
? ? ? ? ? ? ? ?4)HMM的應用
? ? ? ? ? ? ? ?5)層次化馬爾科夫模型與馬爾科夫網絡

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?? 提出原因,HMM存在兩個問題
? ? ? ? ? ? ? ?6)最大熵馬爾科夫模型
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?優點:與HMM相比,允許使用特征刻畫觀察序列,訓練高效
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?缺點: 存在標記偏置問題

? ? ? ? ? ? ? ?7)條件隨機場及其應用(概念,模型過程,與HMM關系)
? ? ? ? ? ? ? ? ? ? ? ? ? ? 參數估計方法(GIS算法,改進IIS算法)

? ? ? ? ? ? ? ? ? ? ? ? ? ? CRF基本問題:特征選取(特征模板)、概率計算、參數訓練、解碼(維特比)

? ? ? ? ? ? ? ? ? ? ? ? ? ? 應用場景:

?? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 詞性標注類問題(現在一般用RNN+CRF)
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?中文分詞(發展過程,經典算法,了解開源工具jieba分詞)
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?中文人名,地名識別

? ? ? ? ? ? ? ?8) ?CRF++

? ? 六、命名實體 識別,詞性標注,內容挖掘、語義分析與篇章分析(大量用到前面的算法)

? ? ? ? ? ? 1)命名實體識別問題

相關概率,定義

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?相關任務類型

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?方法(基于規程->基于大規模語料庫)

2)未登錄詞的解決方法(搜索引擎,基于語料)

? ? ? ? ? ? ? 3)CRF解決命名實體識別(NER)流程總結:

? ? ? ? ? ? ? ? ? ? ? ?訓練階段:確定特征模板,不同場景(人名,地名等)所使用的特征模板不同,對現有語料進行分詞,在分詞結 ? ? ? ? ? ? ? ? ? ? ?果基礎上進行詞性標注(可能手工),NER對應的標注問題是基于詞的,然后訓練CRF模型,得到對應權值參數值

? ? ? ? ? ? ? ? ? ? ? ?識別過程:將待識別文檔分詞,然后送入CRF模型進行識別計算(維特比算法),得到標注序列,然后根據標 ? ? ? ? ? ? ? ? ? ? ? ? ? ?注劃分出命名實體

? ? ? ? ? ? ? 4)詞性標注(理解含義,意義)及其一致性檢查方法(位置屬性向量,詞性標注序列向量,聚類或者分類算法)

? ? ? ? ? ??
? ? 七、句法分析

? ? ? ? ? ? ? 1)句法分析理解以及意義

? ? ? ? ? ? ? ? ? ? ? ? ? ?1、句法結構分析
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 完全句法分析
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ?淺層分析(這里有很多方法。。。)
? ? ? ? ? ? ? ? ? ? ? ? ? ?2、 依存關系分析

? ? ? ? ? ?? 2)句法分析方法

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 1、基于規則的句法結構分析
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 2、基于統計的語法結構分析

? ? 八、文本分類,情感分析

? ? ? ? ? ? ? ?1)文本分類,文本排重

文本分類:在預定義的分類體系下,根據文本的特征,將給定的文本與一個或者多個類別相關聯典型應用:垃圾郵件判定,網頁自動分類

? ? ? ? ? ? ? ?2)文本表示,特征選取與權重計算,詞向量

? ? ? ? ? ? ? ? ? ? ? ? ? 文本特征選擇常用方法:

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 1、基于本文頻率的特征提取法
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 2、信息增量法
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 3、X2(卡方)統計量
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 4、互信息法

? ? ? ? ? ? ? ?3)分類器設計

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? SVM,貝葉斯,決策樹等
? ? ? ? ? ? ? ?4)分類器性能評測

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 1、召回率
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 2、正確率
? ? ? ? ? ? ? ? ? ? ? ? ? ? ? ? 3、F1值

? ? ? ? ? ? ? ?5)主題模型(LDA)與PLSA

? ? ? ? ? ? ? ? ? ? ? ? ? ? ? LDA模型十分強大,基于貝葉斯改進了PLSA,可以提取出本章的主題詞和關鍵詞,建模過程復雜,難以理解。

? ? ? ? ? ? ? ?6)情感分析

? ? ? ? ? ? ? ? ? ? ? ? ?借助計算機幫助用戶快速獲取,整理和分析相關評論信息,對帶有感情色彩的主觀文本進行分析,處理和歸納例如,評論自動分析,水軍識別。

? ? ? ? ? ? ? ? ? ? ? ? 某種意義上看,情感分析也是一種特殊的分類問題
? ? ? ? ? ? ? ?7)應用案例


? ? 九、信息檢索,搜索引擎及其原理

? ? ? ? ? ? ? 1)信息檢索起源于圖書館資料查詢檢索,引入計算機技術后,從單純的文本查詢擴展到包含圖片,音視頻等多媒體信息檢索,檢索對象由數據庫擴展到互聯網。

1、點對點檢索2、精確匹配模型與相關匹配模型3、檢索系統關鍵技術:標引,相關度計算2)常見模型:布爾模型,向量空間模型,概率模型3)常用技術:倒排索引,隱語義分析(LDA等) ??4)評測指標?

? ? 十、自動文摘與信息抽取,機器翻譯,問答系統

? ? ? ? ? ? ? 1)統計機器翻譯的的思路,過程,難點,以及解決

? ? ? ? ? ? 2)問答系統

? ? ? ? ? ? ? ? ? ? 基本組成:問題分析,信息檢索,答案抽取

? ? ? ? ? ? ? ? ? ? 類型:基于問題-答案, 基于自由文本

? ? ? ? ? ? ? ? ? ? 典型的解決思路

? ? ? ? ? ?3)自動文摘的意義,常用方法

? ? ? ? ? ?4)信息抽取模型(LDA等)
?
? ? 十一、深度學習在自然語言中的應用 ?

? ? ? ? ? ? ?1)單詞表示,比如詞向量的訓練(wordvoc)
? ? ? ? ? ? ?2)自動寫文本
? ? ? ? ? ? ? ? ? ? ? ? ? ? 寫新聞等
? ? ? ? ? ? ?3)機器翻譯
? ? ? ? ? ? ?4)基于CNN、RNN的文本分類

5)深度學習與CRF結合用于詞性標注
? ? ? ? ? ? ? ? ? ? ? ?...............

? ? ? ? ?更多深度學習內容,可參考我之前的文章。
? ? ?


?

《新程序員》:云原生和全面數字化實踐50位技術專家共同創作,文字、視頻、音頻交互閱讀

總結

以上是生活随笔為你收集整理的【自然语言处理】自然语言处理(NLP)知识结构总结的全部內容,希望文章能夠幫你解決所遇到的問題。

如果覺得生活随笔網站內容還不錯,歡迎將生活随笔推薦給好友。

主站蜘蛛池模板: 天天拍夜夜爽 | 国产欧美日韩成人 | 日韩精品一区不卡 | 日本高清黄色 | 女女百合高h喷汁呻吟玩具 www.亚洲一区 | 青青草黄色 | 免费网站观看www在线观 | 一区视频在线免费观看 | av免费看网站 | 国产真实乱偷精品视频 | av天天射| 国产精品老熟女视频一区二区 | 女人裸体无遮挡 | 中文字幕一区二区人妻痴汉电车 | 国产精品网站在线 | 日本一区高清 | 无遮挡裸光屁屁打屁股男男 | 精品欧美一区二区三区久久久 | 人人妻人人爽人人澡人人精品 | 小镇姑娘1979版 | 亚洲一级Av无码毛片久久精品 | 国产精品成人va在线观看 | 波多野结衣视频在线观看 | 开心激情深爱 | 中文字幕精品一区二 | av一区二区三区免费观看 | 可以看的毛片 | 好男人网站 | 天天做天天干 | 国产成人中文字幕 | 亚洲1级片| 久久精品国产99久久不卡 | 在线成人中文字幕 | 国产精品18久久久 | 久久精品无码一区 | 男女扒开双腿猛进入爽爽免费 | 黄页网站免费在线观看 | 久久嫩草视频 | 欧美一区二区三区视频 | 久久久久久久av | 一本色道无码道dvd在线观看 | 日韩一级视频在线观看 | 日本三级在线 | 日本国产一区二区三区 | 一级大毛片 | 狠狠躁夜夜躁人人爽天天高潮 | 男生舔女生胸 | 美女黄色小视频 | 香蕉久久精品日日躁夜夜躁 | 欧美大白屁股 | 少妇高潮惨叫久久久久久 | 快射视频在线观看 | 国产精品久久久久久久久久久久久久久 | 免费av视屏 | 亚洲最大黄网 | 色一情一乱一伦一区二区三区 | 麻豆影视在线观看 | 国产一区免费观看 | 欧美色涩| 免费看美女被靠到爽的视频 | 欧美日韩视频在线观看一区 | 日皮视频在线观看 | 高清国产一区二区三区 | 一区二区日韩av | 久久久久一区二区精码av少妇 | 香蕉网站在线 | av看片资源 | 免费观看视频一区二区 | 亚洲好看站 | 亚洲av男人的天堂在线观看 | 日韩成人在线网站 | 污污视频网站免费观看 | 一区二区三区四区五区六区 | 亚洲va欧美va天堂v国产综合 | 中文在线а√天堂官网 | 亚洲欧美一区二区三区孕妇 | 中文字幕日韩专区 | 性xxxx搡xxxxx搡欧美 | 老女人性生活视频 | 激情福利社 | 97成人免费| 在线免费观看av片 | 亚洲666| 亚洲v欧美v另类v综合v日韩v | 久久久久亚洲AV成人无码国产 | 蜜桃视频色 | 91蜜桃视频在线观看 | 91精品综合| 天天色综合久久 | 视频一区二区三 | 激情小说欧美色图 | 杨幂毛片午夜性生毛片 | 精品网站| av色区| 欧美日韩亚洲国产综合 | 免费无遮挡无码永久视频 | 丰满熟女人妻一区二区三区 | 99re视频| 亚洲一区二区三区四区视频 |