近日,由中國圖象圖形學學會主辦的2024中國圖象圖形大會在西安開幕。大會通過20多場論壇、百余項成果,集中展示了生成式人工智能、大模型、機器學習、類腦計算等多個圖像圖形領域的進展。
大模型一路“高歌猛進”的背后,隱藏著一場關于模型訓練語料的“能源危機”。根據人工智能研究人員小組Epoch研究估計,機器學習數據集可能會在2026年前耗盡所有“高質量語言數據”。現階段,大量的高質量語料數據存在于書籍、論文、研報、企業文檔等文檔之中,復雜的版面結構制約了大模型的訓練語料處理及大模型文檔問答的應用能力。文檔解析技術的進步,讓機器能夠識別文檔中的多種元素,更好地處理文本、表格、圖像等多類型數據,還原文檔閱讀順序,加速大模型訓練與應用。
大會期間,由CSIG文檔圖像分析與識別專委會與上海合合信息科技股份有限公司(簡稱“合合信息”)聯合主辦了“大模型技術及其前沿應用”論壇。論壇上,合合信息智能創新事業部研發總監常揚表示,文檔解析的難點在于如何準確識別文檔中的各個元素,并理解其之間的邏輯關系,需要關注“物理版面分析”和“邏輯版面分析”。
據常揚介紹,物理版面分析側重于視覺特征、文檔布局,主要任務是把相關性高的文字聚合到一個區域,比如一個段落,一個表格等等,并選用目標檢測任務進行建模,使用基于回歸的單階段檢測模型進行擬合,從而獲得文檔中各種各樣的布局方式;邏輯版面分析側重于對語義特征的分析,主要任務是把不同的文字塊根據語義建模,例如通過語義的層次關系,形成一個目錄樹結構。
此外,文檔解析技術中文檔元素檢測、文字表格識別、文檔版面分析、閱讀順序還原等任務涉及對版面元素和版面整體布局的判斷,是文檔處理領域典型的技術難題。
“我們研究過程中發現,真實世界的文檔有著極為豐富的布局類型,沒法單純地用單欄,雙欄、三欄等類別去定義。”常揚表示,近年來的開放詞匯目標檢測,視覺語義對齊等工作,以及生成式模型等前沿進展,將給版面分析帶來新的研究思路。
輕點鼠標,登錄系統,在對話框中輸入“鎂碳磚抗熱震性優化方案”,僅需幾秒鐘,一份邏輯嚴密、數據翔實的分析報告便自動生成。近日,全球首個耐火材料垂直領域大模型“祝融·耐火智工”上線試用,該模型由武漢科技大......
7月29日,第三屆海岸帶大會在山東煙臺召開。中國科學院地理科學與資源研究所研究員、“坤元”大模型首席科學家蘇奮振發布了兩款自主研發的大模型——“坤元·感東南”與“坤元·擬千海”。兩款大模型分別針對陸和......
近日,由哈爾濱工程大學研發的國內首個船海學科教育專有大模型——“興海”大模型,在國家高教智慧教育平臺正式上線。“興海”教育專有大模型以DeepSeek、文心一言、Kimi三大模型作為支撐。大模型由哈工......
5月18日,由國家腎臟病臨床醫學研究中心(南方醫科大學南方醫院)牽頭研發的“慢性腎臟病綜合管理大模型——智腎”在南方醫科大學南方醫院正式發布。同時宣布將贈送“智腎”大模型給貴州省人民醫院、新疆醫科大學......
近日,中醫藥交叉學科和智能科學大會在中國中醫科學院舉辦,大會主題為“AI創新中醫發展、數智均衡醫療資源”。國家中醫藥管理局副局長、中國中醫科學院院長、中國工程院院士黃璐琦表示,中醫藥傳承數千年,積累了......
今年的政府工作報告提出,支持大模型廣泛應用,并將其作為激發數字經濟創新活力的核心舉措之一。此舉體現了我國對人工智能技術和數字經濟發展的前瞻性布局,大模型成為帶動千行百業生產力提升的新工具,更有望成為推......
2月16日,北京協和醫院與中國科學院自動化研究所共同研發的“協和·太初”罕見病大模型正式進入臨床應用階段。據悉,該模型基于我國罕見病知識庫的多年積累和中國人群基因檢測數據支撐,是國際首個符合中國人群特......
近日,廣東醫科大學健康醫療大數據工程中心攜手華為技術團隊共同打造的“DeepSeek-GDMU”大模型正式落地。記者獲悉,“DeepSeek-GDMU”大模型是國內首個基于昇騰人工智能(AI)生態的醫......
“當前,人工智能技術以驚人的速度發展,如近期DeepSeek引領了低成本開發使用大模型的革新,這既為驅動新的創新提供了更多可能,也帶來了諸多風險挑戰,而在互聯互通時代,加強國際合作至關重要。”2月11......
1月20日,國產AI大模型DeepSeek正式發布新版本DeepSeek-R1,并同步開源模型權重。開發者表示,DeepSeek-R1在后訓練階段大規模使用了強化學習技術,在僅有極少標注數據的情況下,......