文檔解析技術破解大模型語料“饑荒”難題
近日,由中國圖象圖形學學會主辦的2024中國圖象圖形大會在西安開幕。大會通過20多場論壇、百余項成果,集中展示了生成式人工智能、大模型、機器學習、類腦計算等多個圖像圖形領域的進展。 大模型一路“高歌猛進”的背后,隱藏著一場關于模型訓練語料的“能源危機”。根據人工智能研究人員小組Epoch研究估計,機器學習數據集可能會在2026年前耗盡所有“高質量語言數據”。現階段,大量的高質量語料數據存在于書籍、論文、研報、企業文檔等文檔之中,復雜的版面結構制約了大模型的訓練語料處理及大模型文檔問答的應用能力。文檔解析技術的進步,讓機器能夠識別文檔中的多種元素,更好地處理文本、表格、圖像等多類型數據,還原文檔閱讀順序,加速大模型訓練與應用。 大會期間,由CSIG文檔圖像分析與識別專委會與上海合合信息科技股份有限公司(簡稱“合合信息”)聯合主辦了“大模型技術及其前沿應用”論壇。論壇上,合合信息智能創新事業部研發總監常揚表示,文檔解析的難點......閱讀全文
OpenAI打包新聞集團版權訓練大模型
ChatGPT再擴容,這次將加入十余家媒體的新聞內容。當地時間5月22日,OpenAI宣布與新聞集團(News Corp)達成多年期協議,將獲得主要新聞和信息出版物的當前和存檔內容,包括《華爾街日報》《巴倫周刊》《紐約郵報》《泰晤士報》《太陽報》等十余家媒體。根據協議,OpenAI將能在ChatGP
全國首個DNA存儲領域預訓練大模型“ChatDNA”發布
近年來,DNA 和人工智能一直都是科技發展的熱門議題。隨著科學技術的進步,它們之間便有了無限的可能性。例如,DNA 和人工智能可以幫助我們更快地研究特定基因組的變異和功能。科學家可以使用人工智能算法來分析大量的 DNA 序列,從而發現有價值的變異和基因功能,為疾病的治療提供線索。DNA 是生物世界中
預訓練模型創業漸入佳境
2月10日,創新工場在京宣布,北京瀾舟科技公司已完成近億元Pre-A輪融資,此次融資由聯想創投、斯道資本共同領投,創新工場跟投。本輪融資瀾舟科技將主要用于自然語言處理(NLP)核心產品的開發和前瞻性研究。瀾舟科技的新一輪融資,是時下圍繞人工智能預訓練大模型的創新創業漸入佳境的生動體現。在瀾舟科技創始
大模型訓練遇“算力荒”,“超智融合”來幫忙
論及當下計算技術的發展方向和趨勢,“超智融合”當仁不讓——在今年6月發布的2024年全球“最節能超算”榜單(Green500)上,位列榜單前三的超算都采用了“超智融合”的技術理念。超智融合,顧名思義,意即“采用融合架構,集成超算和智算的功能”。在當前大模型訓練不斷需要大算力支持的時代背景下,超智融合
高文:將訓練大模型底座面向全社會開放
·高文表示,開發大模型不是拍腦袋、喊口號那么容易,而是必須擁有算力,只有投入幾十億元甚至上百億元才能做出“像樣的東西”,但這筆資金對于高校和初創企業而言是一個門檻。“我們基本的想法就是用鵬城實驗室的算力、公開渠道的數據,訓練出大模型底座面向全社會開放,供研究人員、創業者使用。”5月22日,中國工程院
面向跨模態遙感數據的生成式預訓練大模型發布
以深度學習為代表的人工智能技術已被應用于多種遙感圖像解譯任務中。遙感數據幅寬大、場景內容復雜,一幅標準景圖像往往就可達數十億像素,覆蓋上萬平方公里,與自然場景數據存在較大差異。大多數現有的深度神經網絡模型是利用自然場景圖像預訓練的權重來進行初始化,在遙感數據解譯任務上的性能和普適性有待進一步提升。中
學術論文正被高價出售給大模型訓練,作者卻零收入
·越來越多的學術出版商正將研究論文賣給科技公司用以訓練人工智能(AI)模型,而作者收入為零。大語言模型(LLM)因訓練數據問題再次引發爭議。日前,國際著名期刊《自然》(《Nature》)雜志編輯伊麗莎白·吉普尼(Elizabeth Gibney)發布一篇題為《你的論文被用來訓練人工智能模型了嗎?幾乎
面對大模型應用門檻高-如何大模型發揮更大價值?
原文地址:http://news.sciencenet.cn/htmlnews/2022/9/485510.shtm 人工智能預訓練大模型的研發,面臨著數據規模大、數據質量參差不齊、模型體積大、訓練難度高、算力需求大等一系列挑戰。在這樣的背景下,如何加速大模型的產業落地,讓大模型發揮更大價值?
用AI生成數據訓練AI或導致模型崩潰
科技日報北京7月25日電?(記者張夢然)《自然》24日正式發表的一篇研究論文指出了一個人工智能(AI)嚴重問題:用AI生成的數據集訓練未來幾代機器學習模型,可能會嚴重“污染”它們的輸出,這被稱為“模型崩潰”。研究顯示,原始內容會在9次迭代以后,變成不相關的“胡言亂語”(演示中一個建筑文本最終變成了野
用AI生成數據訓練AI或導致模型崩潰
《自然》24日正式發表的一篇研究論文指出了一個人工智能(AI)嚴重問題:用AI生成的數據集訓練未來幾代機器學習模型,可能會嚴重“污染”它們的輸出,這被稱為“模型崩潰”。研究顯示,原始內容會在9次迭代以后,變成不相關的“胡言亂語”(演示中一個建筑文本最終變成了野兔的名字),這凸顯出使用可靠數據訓練
搶抓大模型行業機會
機器人在7月6日舉行的2023世界人工智能大會展會現場進行投籃表演。大會展示包括大模型、芯片、機器人、智能駕駛等領域的科技成果。 新華社記者 方 喆攝 今年以來,自ChatGPT發布后,多家企業先后發布了自己的大模型產品,業內稱之為“百模大戰”。與此同時,產業界對大模型的關注點也在發生變化,從
AI大模型“拿捏”電池壽命
作為現代生活中不可或缺的能源載體,電池的重要性不言而喻。從清晨喚醒我們的鬧鐘,到隨身攜帶的手機、平板電腦等智能設備,無一不依賴于電池提供的穩定電力。此外,隨著科技的發展,電動汽車、無人機等新興領域也廣泛應用了各類高性能電池,推動了綠色出行和智能科技的進步。因此,電池不僅極大地便利了我們的日常生活,還
《自然》封面:以AI生成數據訓練AI,模型變傻?
大模型有許多“崩”的時候,但有一種崩潰叫做“自毀前程”—— 近日,《自然》發表在封面的一篇論文指出,用AI生成的數據集訓練未來幾代機器學習模型,可能會“污染”它們的輸出。這項由英國牛津大學、劍橋大學、帝國理工學院、加拿大多倫多大學等多所高校聯合開展的研究顯示,原始內容會在數代內變成不相關的“胡
《自然》封面:以AI生成數據訓練AI,模型變傻?
大模型有許多“崩”的時候,但有一種崩潰叫做“自毀前程”——近日,《自然》發表在封面的一篇論文指出,用AI生成的數據集訓練未來幾代機器學習模型,可能會“污染”它們的輸出。這項由英國牛津大學、劍橋大學、帝國理工學院、加拿大多倫多大學等多所高校聯合開展的研究顯示,原始內容會在數代內變成不相關的“胡言亂語”
國內首個漁業大模型范蠡大模型1.0發布
6月15日,范蠡大模型1.0 發布暨新質生產力推動京津冀現代漁業發展研討會在京舉行。會上發布了國內首個漁業大模型范蠡大模型1.0。范蠡大模型1.0由國家數字漁業創新中心主任、中國農業大學信息與電氣工程學院教授李道亮團隊聯合中國聯通、中國電信、中國移動三家運營商,以及全國主要水產院校和科研機構共同研發
國內首個漁業大模型范蠡大模型1.0發布
6月15日,范蠡大模型1.0 發布暨新質生產力推動京津冀現代漁業發展研討會在京舉行。會上發布了國內首個漁業大模型范蠡大模型1.0。 范蠡大模型1.0由國家數字漁業創新中心主任、中國農業大學信息與電氣工程學院教授李道亮團隊聯合中國聯通、中國電信、中國移動三家運營商,以及全國主要水產院校和科研機構
大模型熱要多點冷思考
行業大模型聚焦特定領域、針對特定場景、解決特定問題,能結合企業自身獨特優勢去精耕細作并賦能行業,從而形成差異化優勢。走向細分領域才有更多機會,綜合考慮行業專業性、持續迭代和綜合成本等因素,行業大模型更容易實現商業價值落地。 用“百模大戰”來形容當下人工智能大模型的火熱程度一點也不夸張。數據顯示
壓縮算法為大語言模型“瘦身”
據美國科學促進會旗下網站19日報道,美國普林斯頓大學和斯坦福大學團隊開發出一種新壓縮算法CALDERA,能精簡大型語言模型(LLM)的海量數據,為LLM“瘦身”。這項算法不僅有助保護數據隱私、節約能源、降低成本,還能推動LLM在手機和筆記本電腦上高效使用。團隊舉例稱,當人們使用ChatGPT時,請求
北京加快大模型應用落地見效
7月1日,2024全球數字經濟大會人工智能專題論壇在中關村國家自主創新示范區會議中心舉辦。記者從論壇獲悉,北京已發布的大模型產品有71個,約占全國一半,人工智能產業高地建設成效顯著。未來,北京將加快實現大模型應用落地見效。人工智能在數字經濟產業發展中具有很強的“頭雁”效應,以大模型為代表的生成式人工
中科聞歌發布雅意大模型
原文地址:http://news.sciencenet.cn/htmlnews/2023/6/502201.shtm
首個量子領域大模型上線了!
百度量子計算研究所所長段潤堯介紹,該量子領域大模型是在百度文心一言的基礎上,使用量子領域高質量數據進行更有針對性的訓練和優化而成的。它能更好地理解量子知識,執行量子領域相關任務。 據介紹,百度量子領域大模型將充分發揮技術協同效應,并提升現有大模型在訓練速度、模型性能、交互效率等各個方面的能力。
“大模型不是萬能的”
“大模型不是萬能的,不能過度神話它。”這句話,《中國科學報》記者今年在不同場合聽到多次。最近一次,是在“CCF太原大模型賦能文物古建保護與傳承論壇”上。自2022年底OpenAI推出大語言模型產品ChatGPT以來,世界仿佛一下子“覺醒”到大模型時代——不僅各“大廠”都在奮力發展大模型,喊出了“所有
伏羲系列氣象大模型2.0面世
中新社上海6月3日電 (記者 陳靜)3日,“走進智能氣象”主題活動暨智能氣象創新生態聯盟成立儀式在上海舉辦。全新升級、面向產業應用的伏羲系列氣象大模型2.0(下文簡稱:“伏羲”2.0)面世,以“伏羲”2.0為核心的智能氣象創新生態聯盟同期成立。“伏羲”是人工智能驅動的次季節尺度氣象大模型,可提供42
釋放AI大模型促消費潛力
??今年的《政府工作報告》提出持續推進“人工智能+”行動,旨在抓住人工智能技術突破機遇,使我國數字技術與制造優勢、市場規模優勢充分結合,推動人工智能大模型廣泛應用,真正賦能千行百業、走進千家萬戶。在構建新發展格局戰略背景下,AI大模型在激活內需市場、促進消費升級等方面充滿“模”力。??隨著人工智能技
帕金森體外模型帕金森體外模型
體外培養的中腦多巴胺能神經元MPTP損傷模型l實驗操作:實驗采用胚胎齡14一16天的大鼠,剖子宮取胎,取胎鼠中腦腹側區。可將多個胚胎來源的組織收集在一起,置Fl2培養基(Gibco)至35mm的培養皿中,以細剪刀剪碎。將2ml含0.125%的胰酶的F12加入到組織中,該混合物于37oC孵育10分鐘后
劉韻潔:中國發展大模型的機會在通用行業大模型
中國工程院院士、紫金山實驗室主任劉韻潔接受采訪時判斷,中國發展大模型的機會在于通用行業大模型。 在日前舉辦的2023中國算力大會間隙,劉韻潔接受媒體采訪時說,“大模型方面,美國走在前面。”中國需要在算力、數據、網絡等方面,進行深入的、專家層面的研究,制定出應對措施和辦法。 他坦言:“當前大模
廈大嘗試AI大模型破譯甲骨文
近日,廈門大學信息學院自然語言處理實驗室教授史曉東團隊申報的“基于甲骨文多模態大模型的多元信息甲骨文輔助考釋模型”入選“探元計劃2024”“創新探索型項目”TOP10榜單。基于甲骨文多模態大模型的多元信息甲骨文輔助考釋模型。廈門大學供圖甲骨文也被稱作“殷墟文字”,距今已有三千多年歷史,是世界四大古文
閉合式四肢骨折固定訓練模型功能解析
知能醫學模型供應的這款閉合式四肢骨折固定訓練模型以成年男性軀體為基準,在模型的上肢前臂和下肢小腿上預設了骨折創傷,可供學員了解人體骨折時所具備的反常運動、成角畸形、活動后產生骨擦音,骨折上下肢需及時用夾板固定,防止反復活動造成骨折周圍血管神經損傷等現象,可用于練習骨折復位方法及骨折固定的方法。功能特
通用大模型的發展路徑與挑戰
當今世界,以大模型為代表的通用人工智能技術在全球范圍內扮演著日益重要的角色,對推動全球科技進步和經濟發展起到重要的作用。 時代的拷問也隨之而至:未來通用大模型的發展路徑是什么?如何構建高效、自主的算法算力?如何利用大模型等先進人工智能技術來構建新一代科學研究的新范式? 日前,第二十六屆中國科
訊飛星火正式發布語音大模型
“聽說今年爾濱特別火,作為南方小土豆還挺想去玩一下的。要不你用東北話介紹下有啥好玩的唄?” 1月30日,科大訊飛舉行星火認知大模型V3.5升級發布會。科大訊飛董事長劉慶峰、研究院院長劉聰發布基于首個全國產算力訓練的訊飛星火V3.5。在實操演示環節,劉聰和訊飛星火V3.5現場互動,后者一口地道的