下單前先比價不花冤枉錢 同款圖書京東價低于抖音6折日媒感慨中國電動汽車/智駕遙遙領(lǐng)先:本田、日產(chǎn)、三菱合并也沒戲消委會吹風機品質(zhì)檢測結(jié)果揭曉 徠芬獨占鰲頭 共話新質(zhì)營銷力,2024梅花數(shù)據(jù)峰會圓滿落幕索尼影像專業(yè)服務 PRO Support 升級,成為會員至少需注冊 2 臺 α 全畫幅相機、3 支 G 大師鏡頭消息稱vivo加碼電池軍備競賽:6500mAh 旗艦機+7500mAh中端機寶馬M8雙門轎跑車明年年初將停產(chǎn),后續(xù)無2026款車型比亞迪:2025 款漢家族車型城市領(lǐng)航智駕功能開啟內(nèi)測雷神預告2025年首次出席CES 將發(fā)布三款不同技術(shù)原理智能眼鏡realme真我全球首發(fā)聯(lián)發(fā)科天璣 8400 耐玩戰(zhàn)神共創(chuàng)計劃iQOO Z9 Turbo長續(xù)航版手機被曝電池加大到6400mAh,搭驍龍 8s Gen 3處理器普及放緩 銷量大跌:曝保時捷將重新評估電動汽車計劃來京東參與榮耀Magic7 RSR 保時捷設(shè)計預售 享365天只換不修國補期間電視迎來換機潮,最暢銷MiniLED品牌花落誰家?美團旗下微信社群團購業(yè)務“團買買”宣布年底停運消息稱微軟正與第三方廠商洽談,試圖合作推出Xbox游戲掌機設(shè)備在海外,要再造一個京東物流?消息稱蘋果正為AirPods開發(fā)多項健康功能,包括心率監(jiān)測和溫度感應一加 Ace 5系列將搭載全新游戲助手:大幅提升游戲體驗東芝全部業(yè)務實現(xiàn)盈利,退市裁員重組后終于賺錢
  • 首頁 > 企業(yè)IT頻道 > 軟件即服務

    文件版式多,掃描格式“還原難”怎么辦?合合信息AI破解版面分析與還原難題

    2023年06月16日 15:45:07   來源:中文科技資訊

      近期,2023年度視覺與學習青年學者研討會 (Vision And Learning SEminar, VALSE) 圓滿落幕。會議由中國人工智能學會、中國圖象圖形學學會主辦,江南大學和無錫國家高新技術(shù)產(chǎn)業(yè)開發(fā)區(qū)管理委員會承辦。超五千名專家學者、知名高校師生以及來自O(shè)PPO、華為、百度、合合信息等科技企業(yè)的研發(fā)人員齊聚大會,共探計算機視覺、圖像處理、模式識別與機器學習前沿技術(shù)的發(fā)展與應用。

      VALSE是一個面向計算機視覺與機器學習領(lǐng)域國內(nèi)外華人青年學者的高規(guī)格學術(shù)研討會,本屆會議專注于視覺知識和多重知識表達、語言文字識別與理解等技術(shù)研發(fā)及應用熱點。文檔的智能化處理是計算機視覺在產(chǎn)業(yè)中的重要應用方向,現(xiàn)階段還面臨著諸多挑戰(zhàn)。作為智能文檔處理領(lǐng)域的代表,合合信息出席會議并進行智能文檔處理技術(shù)研發(fā)與實踐成果分享。

      VALSE Workshop環(huán)節(jié),合合信息技術(shù)代表就《智能文檔圖像處理技術(shù)應用與實踐》主題進行分享

      合合信息相關(guān)技術(shù)人員提到,隨著OCR技術(shù)應用面的持續(xù)拓寬,復雜多變的版面、多樣化的文本內(nèi)容給文檔的識別和還原帶來了新的挑戰(zhàn)。“版面分析與文檔還原”技術(shù)對提升文檔圖像電子化的視覺效果、信息提取精準度非常關(guān)鍵,是公司重點發(fā)力的方向之一。

      文檔中通常含有大量的圖片、表格等非文字內(nèi)容,一篇普通的論文或者文稿,除文字信息外,其版面往往包含頁眉、頁腳、表格、二維碼等多種元素。在向系統(tǒng)輸入文檔圖像后,機器會對文字部分和版面元素進行分析和識別,把若干行文字關(guān)聯(lián)起來,從而獲得正確的順序與段落關(guān)系,這便是版面分析技術(shù)。

      版面分析的任務目標被分為物理版面分析和邏輯版面分析兩類,前者主要解決區(qū)域分割問題,后者則關(guān)注區(qū)域之間的邏輯關(guān)系或閱讀順序。如何精準地辨別各類元素,并在文檔電子化過程中讓它們回歸到應有的位置,是該項技術(shù)的難點之一。

      如果無法提升版面分析的精準度,文件材料在被拍照、掃描成電子文檔的過程中便可能出現(xiàn)漏字、錯位的現(xiàn)象,圖片轉(zhuǎn)Word、圖片轉(zhuǎn)Excel等“可編輯”性的需求將無法被滿足。

      “版面分析與文檔還原技術(shù)能夠幫助機器‘看懂’文檔結(jié)構(gòu),讓文檔電子化獲得‘所見即所得’的處理效果。”分享環(huán)節(jié)中,合合信息技術(shù)人員提到,文檔圖片的格式轉(zhuǎn)化流程中,在檢測、識別完出文字信息中的字符、坐標信息,以及版面中段落、印章、表格等元素信息后,機器才能“理解”文檔的組成,更好地將圖像“還原”成一個可編輯的Word或Excel文件。

      合合信息“智能文檔處理——文檔還原系統(tǒng)架構(gòu)”展示

      據(jù)了解,合合信息版面分析技術(shù)通過解決版面分割、區(qū)域間的邏輯關(guān)系處理等方面的難題,可將文檔圖像切分成不同類型內(nèi)容(文本、圖形、公式、表格等)的區(qū)域,并分析區(qū)域之間的關(guān)系,讓機器更精準地確定文檔中的文字位置、字體、大小和排版方式,從各類版式復雜的圖片文檔中精準獲取信息。

      合合信息“版面分析與還原”技術(shù)處理效果展示

      未來,合合信息將持續(xù)為全球企業(yè)和個人用戶提供創(chuàng)新的數(shù)字化、智能化服務,助力個人文檔處理效率提升,加速企業(yè)全生命周期文檔電子化進程。

      文章內(nèi)容僅供閱讀,不構(gòu)成投資建議,請謹慎對待。投資者據(jù)此操作,風險自擔。

    [No. S013]
    分享到微信

    即時

    新聞

    明火炊具市場:三季度健康屬性貫穿全類目

    奧維云網(wǎng)(AVC)推總數(shù)據(jù)顯示,2024年1-9月明火炊具線上零售額94.2億元,同比增加3.1%,其中抖音渠道表現(xiàn)優(yōu)異,同比有14%的漲幅,傳統(tǒng)電商略有下滑,同比降低2.3%。

    企業(yè)IT

    重慶創(chuàng)新公積金應用,“區(qū)塊鏈+政務服務”顯成效

    “以前都要去窗口辦,一套流程下來都要半個月了,現(xiàn)在方便多了!”打開“重慶公積金”微信小程序,按照提示流程提交相關(guān)材料,僅幾秒鐘,重慶市民曾某的賬戶就打進了21600元。

    3C消費

    華碩ProArt創(chuàng)藝27 Pro PA279CRV顯示器,高能實力,創(chuàng)

    華碩ProArt創(chuàng)藝27 Pro PA279CRV顯示器,憑借其優(yōu)秀的性能配置和精準的色彩呈現(xiàn)能力,為您的創(chuàng)作工作帶來實質(zhì)性的幫助,雙十一期間低至2799元,性價比很高,簡直是創(chuàng)作者們的首選。

    研究

    中國信通院羅松:深度解讀《工業(yè)互聯(lián)網(wǎng)標識解析體系

    9月14日,2024全球工業(yè)互聯(lián)網(wǎng)大會——工業(yè)互聯(lián)網(wǎng)標識解析專題論壇在沈陽成功舉辦。