15,049
edits
(→O) Tags: Mobile edit Mobile web edit |
mNo edit summary |
||
| (7 intermediate revisions by the same user not shown) | |||
| Line 1: | Line 1: | ||
資料科學 (Data Science)、自然語言處理(Natural Language Processing, NLP)相關詞彙 | |||
{{Template:Draft}} | {{Template:Draft}} | ||
== C == | == C == | ||
* [https://en.wikipedia.org/wiki/Catastrophic_interference Catastrophic Forgetting] 災難性遺忘、災難性失憶; 灾难性遗忘。「災難性遺忘是神經網路在學習新資訊時忘記舊資訊的問題,這與人類記憶的穩定性形成對比。減少干擾的方法:包括使用正交向量、半分佈表示、創新規則、預訓練、重複機制和生成重放等技術。」(資料來源:[https://en.wikipedia.org/wiki/Catastrophic_interference 維基百科]) | |||
* [https://en.wikipedia.org/wiki/Computational_linguistics computational linguistics]; [https://zh.wikipedia.org/zh-tw/%E8%AE%A1%E7%AE%97%E8%AF%AD%E8%A8%80%E5%AD%A6 計算語言學]、電腦語言學; 计算语言学 | * [https://en.wikipedia.org/wiki/Computational_linguistics computational linguistics]; [https://zh.wikipedia.org/zh-tw/%E8%AE%A1%E7%AE%97%E8%AF%AD%E8%A8%80%E5%AD%A6 計算語言學]、電腦語言學; 计算语言学 | ||
* [https://en.wikipedia.org/wiki/Coreference Coreference]; [https://zh.wikipedia.org/zh-tw/%E6%8C%87%E4%BB%A3 指代] | * [https://en.wikipedia.org/wiki/Coreference Coreference]; [https://zh.wikipedia.org/zh-tw/%E6%8C%87%E4%BB%A3 指代] | ||
| Line 10: | Line 11: | ||
== D == | == D == | ||
* [https://en.wikipedia.org/wiki/Discourse_analysis discourse analysis]; [https://zh.wikipedia.org/zh-tw/%E7%AF%87%E7%AB%A0%E5%88%86%E6%9E%90 篇章分析]、言談分析; 篇章分析、[https://baike.baidu.com/item/%E8%AF%AD%E7%AF%87%E5%88%86%E6%9E%90 语篇分析]。「分析口語、書面語言、手語、肢體語言等等不同的語言行為(Speech acts)及言外行為。」(資料來源: 維基百科 [https://zh.wikipedia.org/zh-tw/%E7%AF%87%E7%AB%A0%E5%88%86%E6%9E%90 篇章分析]) | * [https://en.wikipedia.org/wiki/Discourse_analysis discourse analysis]; [https://zh.wikipedia.org/zh-tw/%E7%AF%87%E7%AB%A0%E5%88%86%E6%9E%90 篇章分析]、言談分析; 篇章分析、[https://baike.baidu.com/item/%E8%AF%AD%E7%AF%87%E5%88%86%E6%9E%90 语篇分析]。「分析口語、書面語言、手語、肢體語言等等不同的語言行為(Speech acts)及言外行為。」(資料來源: 維基百科 [https://zh.wikipedia.org/zh-tw/%E7%AF%87%E7%AB%A0%E5%88%86%E6%9E%90 篇章分析]) | ||
* Data Voids; 資料空白:2018 年由 Michael Golebiewski 和 danah boyd 提出「某些關鍵詞彙在網路上缺乏足夠、可靠、或多元的內容,使搜尋引擎在回應這些查詢時容易呈現偏頗、低品質或被操弄的資訊。」<ref>Data Voids: | |||
Where Missing Data Can Easily Be Exploited https://datasociety.net/wp-content/uploads/2018/05/Data_Society_Data_Voids_Final_3.pdf</ref> | |||
== E == | == E == | ||
* EMNLP (Empirical Methods in Natural Language Processing) is a "leading conference in the area of natural language processing and artificial intelligence."<ref>[https://en.wikipedia.org/wiki/Empirical_Methods_in_Natural_Language_Processing Empirical Methods in Natural Language Processing - Wikipedia]</ref> 「自然語言處理實務研討會」,研討會網站 [https://2021.emnlp.org/ EMNLP 2021]。 | * EMNLP (Empirical Methods in Natural Language Processing) is a "leading conference in the area of natural language processing and artificial intelligence."<ref>[https://en.wikipedia.org/wiki/Empirical_Methods_in_Natural_Language_Processing Empirical Methods in Natural Language Processing - Wikipedia]</ref> 「自然語言處理實務研討會」,研討會網站 [https://2021.emnlp.org/ EMNLP 2021]。 | ||
== I == | == I == | ||
| Line 32: | Line 29: | ||
== N == | == N == | ||
* [https://en.wikipedia.org/wiki/Named-entity_recognition Named-entity recognition] (NER); [https://zh.wikipedia.org/zh-tw/%E5%91%BD%E5%90%8D%E5%AE%9E%E4%BD%93%E8%AF%86%E5%88%AB 命名實體識別]; 命名实体识别。「識別文本中具有特定意義的實體,主要包括人名、地名、機構名、專有名詞等,以及時間、數量、貨幣、比例數值等文字。」(資料來源: [https://zh.wikipedia.org/zh-tw/%E5%91%BD%E5%90%8D%E5%AE%9E%E4%BD%93%E8%AF%86%E5%88%AB 维基百科])。相關頁面:[[Named entity recognition tools]] | * [https://en.wikipedia.org/wiki/Named-entity_recognition Named-entity recognition] (NER); [https://zh.wikipedia.org/zh-tw/%E5%91%BD%E5%90%8D%E5%AE%9E%E4%BD%93%E8%AF%86%E5%88%AB 命名實體識別]; 命名实体识别。「識別文本中具有特定意義的實體,主要包括人名、地名、機構名、專有名詞等,以及時間、數量、貨幣、比例數值等文字。」(資料來源: [https://zh.wikipedia.org/zh-tw/%E5%91%BD%E5%90%8D%E5%AE%9E%E4%BD%93%E8%AF%86%E5%88%AB 维基百科])。相關頁面:[[Named entity recognition tools]] | ||
* Neologism learning (新詞學習) | |||
* NLU ([https://en.wikipedia.org/wiki/Natural-language_understanding Natural-language understanding]): [https://zh.wikipedia.org/zh-tw/%E8%87%AA%E7%84%B6%E8%AF%AD%E8%A8%80%E7%90%86%E8%A7%A3 自然語言理解] / 自然语言理解。「目標研究如何讓電腦讀懂人類語言。商業應用有電腦理解、機器翻譯、對話、新聞蒐集、語音介面」(資料來源: [https://zh.wikipedia.org/zh-tw/%E5%91%BD%E5%90%8D%E5%AE%9E%E4%BD%93%E8%AF%86%E5%88%AB 维基百科]) | * NLU ([https://en.wikipedia.org/wiki/Natural-language_understanding Natural-language understanding]): [https://zh.wikipedia.org/zh-tw/%E8%87%AA%E7%84%B6%E8%AF%AD%E8%A8%80%E7%90%86%E8%A7%A3 自然語言理解] / 自然语言理解。「目標研究如何讓電腦讀懂人類語言。商業應用有電腦理解、機器翻譯、對話、新聞蒐集、語音介面」(資料來源: [https://zh.wikipedia.org/zh-tw/%E5%91%BD%E5%90%8D%E5%AE%9E%E4%BD%93%E8%AF%86%E5%88%AB 维基百科]) | ||
* NLP ([https://en.wikipedia.org/wiki/Natural_language_processing Natural language processing]): [https://zh.wikipedia.org/zh-tw/%E8%87%AA%E7%84%B6%E8%AF%AD%E8%A8%80%E5%A4%84%E7%90%86 自然語言處理] / 自然语言处理。「此領域探討如何處理及運用自然語言;自然語言處理的挑戰包括有語音識別、自然語言理解、自然語言生成等部分。」(資料來源: [https://zh.wikipedia.org/zh-tw/%E8%87%AA%E7%84%B6%E8%AF%AD%E8%A8%80%E5%A4%84%E7%90%86 维基百科]) | * NLP ([https://en.wikipedia.org/wiki/Natural_language_processing Natural language processing]): [https://zh.wikipedia.org/zh-tw/%E8%87%AA%E7%84%B6%E8%AF%AD%E8%A8%80%E5%A4%84%E7%90%86 自然語言處理] / 自然语言处理。「此領域探討如何處理及運用自然語言;自然語言處理的挑戰包括有語音識別、自然語言理解、自然語言生成等部分。」(資料來源: [https://zh.wikipedia.org/zh-tw/%E8%87%AA%E7%84%B6%E8%AF%AD%E8%A8%80%E5%A4%84%E7%90%86 维基百科]) | ||
| Line 52: | Line 50: | ||
** (1) telic: 有事件或狀態的終結點 (endpoint) 的動詞,例如「約翰蓋了一間房子」 | ** (1) telic: 有事件或狀態的終結點 (endpoint) 的動詞,例如「約翰蓋了一間房子」 | ||
** (2) atelic: 沒有終結點的動詞,例如「約翰蓋房子蓋了一個月」。參考資料:[https://en.wikipedia.org/wiki/Telicity 維基百科]、[https://blog.droidtown.co/post/189716361582/telicity 中文文法:telicity 這動作有停下來的一天嗎? - Droidtown.co] | ** (2) atelic: 沒有終結點的動詞,例如「約翰蓋房子蓋了一個月」。參考資料:[https://en.wikipedia.org/wiki/Telicity 維基百科]、[https://blog.droidtown.co/post/189716361582/telicity 中文文法:telicity 這動作有停下來的一天嗎? - Droidtown.co] | ||
* [https://en.wikipedia.org/wiki/Text_mining Text mining] ([https://zh.wikipedia.org/wiki/%E6%96%87%E6%9C%AC%E6%8C%96%E6%8E%98 文本挖掘]、文字探勘、文本挖掘) 「從文本處理過程中取得高質量的訊息」 (來源: [https://zh.wikipedia.org/wiki/%E6%96%87%E6%9C%AC%E6%8C%96%E6%8E%98 維基百科]) | * [https://en.wikipedia.org/wiki/Text_mining Text mining] ([https://zh.wikipedia.org/wiki/%E6%96%87%E6%9C%AC%E6%8C%96%E6%8E%98 文本挖掘]、文字探勘、文本挖掘) 「從文本處理過程中取得高質量的訊息」 (來源: [https://zh.wikipedia.org/wiki/%E6%96%87%E6%9C%AC%E6%8C%96%E6%8E%98 維基百科]) | ||
| Line 66: | Line 62: | ||
# [https://zh.wikipedia.org/zh-tw/Category:%E8%AE%A1%E7%AE%97%E8%AF%AD%E8%A8%80%E5%AD%A6 分類:計算語言學 - 維基百科,自由的百科全書] 或 [https://en.wikipedia.org/wiki/Category:Computational_linguistics Category:Computational linguistics - Wikipedia] | # [https://zh.wikipedia.org/zh-tw/Category:%E8%AE%A1%E7%AE%97%E8%AF%AD%E8%A8%80%E5%AD%A6 分類:計算語言學 - 維基百科,自由的百科全書] 或 [https://en.wikipedia.org/wiki/Category:Computational_linguistics Category:Computational linguistics - Wikipedia] | ||
# [https://en.wikipedia.org/wiki/Category:Natural_language_processing Category:Natural language processing - Wikipedia] | # [https://en.wikipedia.org/wiki/Category:Natural_language_processing Category:Natural language processing - Wikipedia] | ||
# [ | # [[Generative AI glossary]] | ||
== 參考資料 == | == 參考資料 == | ||