首页
/
每日頭條
/
生活
/
深度分析近義詞
深度分析近義詞
更新时间:2025-11-12 21:35:20

脫離上下文時,每個英文單詞都有多重含義。例如,“bank”可以指銀行或河岸;“Fair”可以指展覽會,也可以指對展覽會的評價;“Duck”可以是躲避傷害的動作,也可以指鴨子。

深度分析近義詞(躲避or鴨子)1

對于人類來說搞清楚一個單詞在某場景中适用的含義是非常簡單的。但是,對于自然語言處理模型就是另一回事了。

近些年已經出現很多用于解析文本的AI工具,但是當涉及到多重含義的單詞時,這些工具往往會陷入困境。來自艾倫人工智能研究所(Allen Institute for Artificial Intelligence)和華盛頓大學的研究人員正在努力解決這一難題,他們使用了可以根據上下文來确定英文單詞含義的神經網絡。

向前和向後閱讀

通常,NLP模型通過詞向量(在每個單詞中附加語言含義和單詞語法的基礎元素)中的結構化數據進行訓練。此算法基于假設每個單詞隻有一種向量表示,但實際上英文單詞并非如此。

研究人員利用名為“ELMo”的神經系統打破了這一假設,此神經系統可以為每個單詞創造出無限數量的向量。

“‘ELMo’是‘Embeddings from Language Models’的縮寫,而不是毛茸茸的紅色芝麻街角色”,論文“Deep contextualized word representations”的第一作者Matthew Peters解釋道。

深度分析近義詞(躲避or鴨子)2

常規語言模型嘗試預測句子中即将出現的下一個單詞。如果片段是“The people sat down on the …,”,那麼算法将預測出“bench”或“grass”之類的單詞。為了給單詞附加所有潛在含義的詞向量,這個團隊使用了雙向語言模型。

使用雙向模型意味着,該模型可以通過一個二次的回顧性算法,獲取句子的結尾并嘗試預測出現在句子結尾前邊的單詞。當模型嘗試分析的單詞出現在句首,并且相關上下文随即出現時,這會非常有用。

“就像‘He lies to his teacher’與‘He lies on the sofa’這種情況”,Peters說道。

為測試ELMo的技能,該團隊利用六種不同的NLP任務(包括情緒分析和問答等)對算法進行測試。與之前使用相同訓練數據的方法相比,ELMo每次都會得到更新、更出色的結果,在某些情況下可以比之前的領先模型提升25%的速度。

“在NLP中,很重要的一點是,單一的方法能夠提高多樣化任務的性能”,Peters指出。

ELMo在半監督式學習領域大放異彩

在進行自然語言處理時,訓練數據的類型非常關鍵。例如,問答系統使用的模型無法在任何舊文本上進行訓練。通常,此類模型需要在由帶标注的問題和答案對組成的大型數據庫中訓練,以學習如何做出正确的回答。

标注數據非常耗時并且成本高昂。因此,研究人員首先選擇使用包含大約十億個單詞的大型無标記學術數據庫來訓練ELMo。然後,針對特定任務(例如問答)将此數據庫調整為一個帶标注的小型數據庫。對于這種結合使用大量無标記數據和一小部分已标記數據的方法,統稱為“半監督式學習”。

減少對已标記和帶标注數據的依賴後,研究人員可以更輕松地在現實問題中應用其NLP模型應用。

“在我們的示例中,我們選擇了一個未标記的學術數據庫來訓練語言模型”,Peters說道。但是研究人員能夠調整算法,以便在任何其他未标記的數據庫中運行該算法,也可以将其應用于生物醫學論文、法律合同或其他語言等專業領域中。

深度分析近義詞(躲避or鴨子)3

與之前最先進(SOTA)的基準相比,ELMo在六個基準NLP任務中都增強了神經模型的性能。從左到右,這些任務依次是:語義推理、命名實體識别、問題回答、指代消解、語義角色标注和情感分類。

研究人員通過Amazon Web Service,使用NVIDIA Tesla V100和K80 GPU助力訓練和推理。

在後續論文中,研究人員指出其僅使用了幾百個已标記示例,便可應用ELMo模式回答幾何問題。人工需要花費幾個小時便能完成此标記工作,但卻會顯著提高NLP模型的性能。

ELMo已作為開源庫提供。Peters表示其他的NLP研究人員已經将此模型應用到了他們自己的工作中,包括除英語外的其他語言。

,
Comments
Welcome to tft每日頭條 comments! Please keep conversations courteous and on-topic. To fosterproductive and respectful conversations, you may see comments from our Community Managers.
Sign up to post
Sort by
Show More Comments
推荐阅读
小米粥隔夜加熱能喝嗎
小米粥隔夜加熱能喝嗎
小米粥隔夜加熱之後是否能喝,需要根據情況判斷,要是隔夜之後沒有出現變質情況,就可以食用,但是要是出現變酸、變馊、有異味的情況,那麼是不能食用的,會對健康早晨不利影響,另外在吃隔夜小米粥之後需要加熱,這樣對身體更好。小米粥能隔夜加熱食用嗎 小米粥很多人都不陌生,它是我們生活中比較常見的一種養胃粥,很多...
2025-11-12
鹽是什麼時候出現的
鹽是什麼時候出現的
相傳我國鹽的起源可以追溯到炎黃時代,海水制鹽的方法由夙沙氏發明,從海水中提取鹽的方法一直到現在都被人們使用。鹽是一種重要的調味料,它還有殺菌、清潔皮膚、去污、護齒、美容等功效。相傳在我國鹽的起源可以追溯到五千年前時的炎黃時代,用海水制鹽的方法就是夙沙氏發明的。因此夙沙氏也被人們尊為“鹽宗”,還有人專...
2025-11-12
橡膠水的用途
橡膠水的用途
橡膠水可以用來修補、粘補車胎、橡膠膠管、傳動帶,同時它在制鞋工業中還可以用來制作襯裡、拔茬等物品。橡膠水通常呈淡黃色或者是無色,它的幹燥速度很快而且有很強的粘合力,是一種比較粘稠的液體。橡膠水有什麼用 橡膠水一般是用來修補、粘補車胎、橡膠膠管、傳動帶之類的天然橡膠制品的,除此之外在制鞋工業中橡膠水還...
2025-11-12
真絲衣物的洗滌方法是什麼
真絲衣物的洗滌方法是什麼
1、水洗:真絲服飾屬蛋白性嬌嫩保健纖維織造而成,洗滌不宜在粗糙物品揉擦和用洗衣機洗滌,應将衣物浸入冷清水中5—10分鐘,用專用真絲洗滌劑合成低泡洗衣粉或中性肥皂輕揉輕搓假如是洗滌絲巾這類小件織物,那麼用好一點是洗發水同樣可以),塗色真絲服飾在清水中反複漂洗即可。2、晾曬:真絲服飾洗滌後不宜日曬,更不...
2025-11-12
新鮮小芋頭怎麼做好吃
新鮮小芋頭怎麼做好吃
要制作好吃的小芋頭,我們需要先把小芋頭去皮、洗淨,然後把處理好的芋頭放入鍋中蒸至八九成熟。接着熱鍋燒油并把芋頭放入其中煎至表面金黃,再往鍋中撒入适量的食鹽、椒鹽繼續煎一會,最後撒入蔥花煸炒一下即可。怎麼做好吃的小芋頭 如果想要做出好吃的新鮮小芋頭的話,就可以先準備小芋頭、香蔥、椒鹽、食鹽、食油這幾樣...
2025-11-12
Copyright 2023-2025 - www.tftnews.com All Rights Reserved