女人自慰AV免费观看内涵网,日韩国产剧情在线观看网址,神马电影网特片网,最新一级电影欧美,在线观看亚洲欧美日韩,黄色视频在线播放免费观看,ABO涨奶期羡澄,第一导航fulione,美女主播操b

0
  • 聊天消息
  • 系統消息
  • 評論與回復
登錄后你可以
  • 下載海量資料
  • 學習在線課程
  • 觀看技術視頻
  • 寫文章/發帖/加入社區
會員中心
創作中心

完善資料讓更多小伙伴認識你,還能領取20積分哦,立即完善>

3天內不再提示

谷歌推出1.6萬億參數的人工智能語言模型,打破GPT-3記錄

hl5C_deeptechch ? 來源:DeepTech深科技 ? 作者:DeepTech深科技 ? 2021-01-18 17:16 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

古諺道:“熟讀唐詩三百首,不會作詩也會吟。” 這句話放在目前的人工智能語言模型中也非常適用。

此前,OpenAI 的研究人員開發出 “GPT-3”,這是一個由 1750 億個參數組成的 AI 語言模型,堪稱有史以來訓練過的最大的語言模型,可以進行原始類比、生成配方、甚至完成基本代碼編寫。

如今,這一記錄被打破了。近日,谷歌研究人員開發出一個新的語言模型,它包含了超過 1.6 萬億個參數,這是迄今為止最大規模的人工智能語言模型,比之前谷歌開發的語言模型 T5-XXL 的規模大了 4 倍。

6735ad0e-584e-11eb-8b86-12bb97331649.png

參數是機器學習算法的關鍵所在,它們是從歷史訓練數據中學習到的模型的一部分。一般而言,在語言領域中參數的數量和復雜度之間的相關性非常好。這一點類似于 GPU晶體管的數量,在同樣的制程工藝下,晶體管越多其算力便越強,而語言模型包含的參數愈多就愈接近人類自然語言。

正如研究人員在一篇論文中指出的那樣,大規模的訓練是通向強大模型的有效途徑,在大數據集和參數計數的支持下,簡單的體系結構遠遠超過了更復雜的算法。但是,有效的大規模培訓在計算上非常密集。這就是為什么研究人員熱衷于他們所說的 “開關變壓器”,這是一種 “稀疏激活” 技術,它只使用模型權重的一個子集或者在模型中轉換輸入數據的參數。

“開關變壓器” 是早在 90 年代初首次提出的一種人工智能模型范例,大體意思是將多個專家或專門處理不同任務的模型放在一個更大的模型中,并有一個 “門控網絡” 來選擇為任何給定數據咨詢哪些專家。

在一項實驗中,研究人員使用 32 個 TPU 內核對幾個不同的 “開關變壓器” 模型進行了預訓練,這些 TPU 內核位于一個從 Reddit、Wikipedia 和其他網絡資源中搜集的 750GB 大小的文本數據語料庫中,任務則是讓這些模型預測段落中 15% 的單詞被遮住的缺失單詞,以及其他挑戰,比如檢索文本來回答一系列越來越難的問題。

研究人員稱,包含了 1.6 萬億參數和 2048 名專家的模型 Switch-C 顯示 “完全沒有訓練不穩定性”。然而,在桑福德問答數據集的基準測試中,Switch-C 的得分居然比僅包含 3950 億個參數和 64 名專家的模型 Switch-XXL 還要低一點,對此,研究人員認為是因為微調質量、計算要求和參數數量之間的不透明關系所致。

在這種情況下,“開關變壓器” 導致了一些下游任務的收益。例如,研究人員稱在使用相同數量的計算資源的情況下,它可以使訓練前的加速速度提高 7 倍以上。他們還證明 “稀疏激活” 技術可以用來創建更小、更密集的模型,這些模型可以對任務進行微調,其質量增益為大型模型的 30%。

對此他們表示:雖然這項工作主要集中在超大模型上,但我們也發現只有兩名專家的模型可以提高性能,同時很容易適應通用 GPU 或 TPU 的內存限制。另外,通過將稀疏模型提取為稠密模型,可以實現 10 到 100 倍的壓縮率,同時獲得專家模型約 30% 的質量增益。

在另一個測試中,“開關變壓器” 模型被訓練在 100 多種不同語言之間進行翻譯,研究人員觀察到 101 種語言的 “普遍改善”,91% 的語言受益于比基線模型快 4 倍以上的速度。未來,研究人員還計劃將 “開關變壓器” 應用于新的領域,比如圖像和文本。他們認為,模型稀疏性可以賦予優勢,在一系列不同的媒體以及多模態模型。

美中不足的是,研究人員的工作沒有考慮到這些語言模型在現實世界中的影響,比如模型通常會放大一些公開數據中的偏見。對此,OpenAI 公司指出,這可能導致在女性代詞附近放置 “淘氣”;而在 “恐怖主義” 等詞附近放置 “伊斯蘭” 等。根據米德爾伯里國際研究所的說法,這種偏見可能被惡意行為者利用,通過散布錯誤信息、造謠和謊言來煽動不和。

而路透社也曾報道稱,谷歌的研究人員現在被要求在研究人臉和情緒分析以及種族分類等話題之前,先咨詢法律、政策和公關團隊,性別或政治派別。

綜上所述,盡管谷歌訓練的 1.6 萬億參數的人工智能語言模型還沒辦法做到真正意義上的人工智能,存在一些不足之處需要完善和優化,但隨著在摩爾定律下電子設備算力的不斷提升,近些年 AI 語言模型參數量級呈指數倍發展,相信在不久的將來,或許真的會出現一個無限接近熟讀人類歷史所有文明記錄的超級模型,能夠和人類完全實現自然語言交流,不妨讓我們好好期待一下吧!

原文標題:GPT-3記錄被打破!谷歌推出1.6萬億參數的人工智能語言模型

文章出處:【微信公眾號:DeepTech深科技】歡迎添加關注!文章轉載請注明出處。

責任編輯:haq

聲明:本文內容及配圖由入駐作者撰寫或者入駐合作網站授權轉載。文章觀點僅代表作者本人,不代表電子發燒友網立場。文章及其配圖僅供工程師學習之用,如有內容侵權或者其他違規問題,請聯系本站處理。 舉報投訴
  • 谷歌
    +關注

    關注

    27

    文章

    6231

    瀏覽量

    108178
  • 人工智能
    +關注

    關注

    1807

    文章

    49029

    瀏覽量

    249655

原文標題:GPT-3記錄被打破!谷歌推出1.6萬億參數的人工智能語言模型

文章出處:【微信號:deeptechchina,微信公眾號:deeptechchina】歡迎添加關注!文章轉載請注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評論

    相關推薦
    熱點推薦

    最新人工智能硬件培訓AI 基礎入門學習課程參考2025版(大模型篇)

    人工智能模型重塑教育與社會發展的當下,無論是探索未來職業方向,還是更新技術儲備,掌握大模型知識都已成為新時代的必修課。從職場上輔助工作的智能助手,到課堂用于學術研究的
    發表于 07-04 11:10

    如何借助大語言模型打造人工智能生態系統

    、硬件需求以及所涉及的財務影響這三者之間的內在聯系。我們將深入探究現實中大語言模型的發展趨勢,并共同探討如何借助規模更小、效能更高的模型,打造一個更具可持續性的人工智能生態系統。
    的頭像 發表于 04-27 09:19 ?567次閱讀
    如何借助大<b class='flag-5'>語言</b><b class='flag-5'>模型</b>打造<b class='flag-5'>人工智能</b>生態系統

    OpenAI即將推出GPT-5模型

    先進技術,其中包括備受矚目的o3工具。通過整合這些技術,GPT-5模型將實現更加強大的功能和性能。 值得一提的是,GPT-5模型將被廣泛應用
    的頭像 發表于 02-13 11:21 ?596次閱讀

    人工智能模型年度發展趨勢報告

    2024年12月的中央經濟工作會議明確把開展“人工智能+”行動作為2025年要抓好的重點任務。當前,以大模型為代表的人工智能正快速演進,激發全球科技之變、產業之變、時代之變,人工智能
    的頭像 發表于 02-13 10:57 ?798次閱讀
    <b class='flag-5'>人工智能</b>大<b class='flag-5'>模型</b>年度發展趨勢報告

    Banana Pi 攜手 ArmSoM 推出人工智能加速 RK3576 CM5 計算模塊

    的機器學習和人工智能 (ML 和 AI) 工作負載,以及 Arm Mali G52-MC3 圖形處理器和支持 H.264/H.265/MJPEG 編碼和 H.265/H.265/VP9/AVI1/AVS2
    發表于 12-11 18:38

    語言模型開發語言是什么

    人工智能領域,大語言模型(Large Language Models, LLMs)背后,離不開高效的開發語言和工具的支持。下面,AI部落小編為您介紹大
    的頭像 發表于 12-04 11:44 ?704次閱讀

    嵌入式和人工智能究竟是什么關系?

    、連接主義和深度學習等不同的階段。目前,人工智能已經廣泛應用于各種領域,如自然語言處理、計算機視覺、智能推薦等。 嵌入式系統和人工智能在許多方面都存在密切的關聯性。首先,嵌入式系統可
    發表于 11-14 16:39

    《AI for Science:人工智能驅動科學創新》第一章人工智能驅動的科學創新學習心得

    ,還促進了新理論、新技術的誕生。 3. 挑戰與機遇并存 盡管人工智能為科學創新帶來了巨大潛力,但第一章也誠實地討論了伴隨而來的挑戰。數據隱私、算法偏見、倫理道德等問題不容忽視。如何在利用AI提升科研效率
    發表于 10-14 09:12

    risc-v在人工智能圖像處理應用前景分析

    長時間運行或電池供電的設備尤為重要。 高性能 : 盡管RISC-V架構以低功耗著稱,但其高性能也不容忽視。通過優化指令集和處理器設計,RISC-V可以在處理復雜的人工智能圖像處理任務時表現出色。 三
    發表于 09-28 11:00

    英偉達預測機器人領域或迎“GPT-3時刻”

    未來2-3年內,機器人基礎模型的研究將迎來重大突破,這一時刻被形象地比喻為機器人領域的“GPT-3時刻”。
    的頭像 發表于 09-20 17:05 ?1080次閱讀

    Jim Fan展望:機器人領域即將迎來GPT-3式突破

    英偉達科學家9月19日,科技媒體The Decoder發布了一則引人關注的報道,英偉達高級科學家Jim Fan在近期預測,機器人技術將在未來兩到三年內迎來類似GPT-3語言處理領域的革命性突破,他稱之為機器人領域的“GPT-3
    的頭像 發表于 09-19 15:13 ?956次閱讀

    人工智能ai4s試讀申請

    目前人工智能在繪畫對話等大模型領域應用廣闊,ai4s也是方興未艾。但是如何有效利用ai4s工具助力科研是個需要研究的課題,本書對ai4s基本原理和原則,方法進行描訴,有利于總結經驗,擬按照要求準備相關體會材料。看能否有助于入門和提高ss
    發表于 09-09 15:36

    名單公布!【書籍評測活動NO.44】AI for Science:人工智能驅動科學創新

    活的世界? 編輯推薦 《AI for Science:人工智能驅動科學創新》聚焦于人工智能與材料科學、生命科學、電子科學、能源科學、環境科學五大領域的交叉融合,通過深入淺出的語言和諸多實際應用案例,介紹了
    發表于 09-09 13:54

    Kiwi Talks | 傳統以太網、UEC超以太網、超節點-Ethernet RDMA 打響進階賽

    推進下一代低延遲以太網 今天的人工智能應用是由大型語言模型(llm)驅動的,這些模型是在大量非結構化數據上訓練的。llm的有效性與訓練中使用的參數
    發表于 07-30 09:16 ?2971次閱讀
    Kiwi Talks | 傳統以太網、UEC超以太網、超節點-Ethernet RDMA 打響進階賽

    【《大語言模型應用指南》閱讀體驗】+ 基礎篇

    今天開始學習《大語言模型應用指南》第一篇——基礎篇,對于人工智能相關專業技術人員應該可以輕松加愉快的完成此篇閱讀,但對于我還是有許多的知識點、專業術語比較陌生,需要網上搜索學習更多的資料才能理解書中
    發表于 07-25 14:33