成都永利304电子游戏公司-電話:028-8265510 首頁 | 聯系方式 | 加入收藏 | 設為首頁
成都永利304电子游戏公司

服務范圍

聯系方式

聯系人:丁小姐
電話:028-8265510
傳真:028-8265510
郵箱: service@blogcozy.com

當前位置:首頁 >> 永利304电子游戏 >> 正文

幸运5分彩开奖

編輯:成都永利304电子游戏公司   時間:2013/06/25   字號:
摘要:幸运5分彩开奖
OCR(Optical Character Recognition웃유ღ♋♂,光學字符識別)⒃⒄⒅⒆⒇⒈⒉⒊⒋⒌⒍⒎⒏⒐⒑⒒⒓,是屬于圖型識別(Pattern Recognition✵✶✷✸✹✺✻✼❄❅,PR)的一門學問⒃⒄⒅⒆⒇⒈⒉⒊⒋⒌⒍⒎⒏⒐⒑⒒⒓。其目的是要讓計算機知道它到底看到了什么⒔⒕⒖⒗⒘⒙⒚⒛ⅠⅡⅢⅣⅤⅥⅦⅧⅨⅩⅪⅫⅰⅱ,尤其是文字資料ⓣⓤⓥⓦⓧⓨⓩ。
OCR的發展:早在60ⓚⓛⓜⓝⓞⓟⓠⓡⓢ、70年代♦☜☞☝✍☚☛☟✌✽✾✿❁❃,世界各國就開始有OCR的研究①②③④⑤⑥⑦⑧⑨⑩⑪⑫⑬⑭⑮⑯,而研究的初期♀☿☼☀☁☂☄,多以文字的識別方法研究為主㈧㈨㈩⑴⑵⑶⑷⑸⑹⑺⑻⑼⑽⑾⑿⒀⒁⒂,且識別的文字僅為0至9的數字㈧㈨㈩⑴⑵⑶⑷⑸⑹⑺⑻⑼⑽⑾⑿⒀⒁⒂。以同樣擁有方塊文字的日本為例ⓚⓛⓜⓝⓞⓟⓠⓡⓢ,1960年左右開始研究OCR的基本識別理論㈧㈨㈩⑴⑵⑶⑷⑸⑹⑺⑻⑼⑽⑾⑿⒀⒁⒂,初期以數字為對象♦☜☞☝✍☚☛☟✌✽✾✿❁❃,直至1965至1970年之間開始有一些簡單的產品♀☿☼☀☁☂☄,如印刷文字的郵政編碼識別系統⒔⒕⒖⒗⒘⒙⒚⒛ⅠⅡⅢⅣⅤⅥⅦⅧⅨⅩⅪⅫⅰⅱ,識別郵件上的郵政編碼㈧㈨㈩⑴⑵⑶⑷⑸⑹⑺⑻⑼⑽⑾⑿⒀⒁⒂,幫助郵局作區域分信的作業⒜⒝⒞⒟⒠⒡⒢⒣⒤;也因此至今郵政編碼一直是各國所倡導的地址書寫方式①②③④⑤⑥⑦⑧⑨⑩⑪⑫⑬⑭⑮⑯。
OCR可以說是一種不確定的技術研究❋❀⚘☑✓✔√☐☒✗✘ㄨ✕✖✖⋆✢✣,正確率就像是一個無窮趨近函數❣❦❧♡۵,知道其趨近值웃유ღ♋♂,卻只能靠近而無法達到⓱⓲⓳⓴⓵⓶⓷⓸⓹⓺⓻⓼⓽⓾,永遠在與100%作拉鋸戰♀☿☼☀☁☂☄。因為其牽扯的因素太多了♦☜☞☝✍☚☛☟✌✽✾✿❁❃,書寫者的習慣或文件印刷品質ⓚⓛⓜⓝⓞⓟⓠⓡⓢ、掃描儀的掃描品質⑰⑱⑲⑳⓪⓿❶❷❸❹❺、識別的方法웃유ღ♋♂、學習及測試的樣本……等等⓱⓲⓳⓴⓵⓶⓷⓸⓹⓺⓻⓼⓽⓾,多少都會影響其正確率☧☬☸✡♁✙♆。,、':∶;,也因此☈⊙☉℃℉❅, OCR的產品除了需有一個強有力的識別核心外㈧㈨㈩⑴⑵⑶⑷⑸⑹⑺⑻⑼⑽⑾⑿⒀⒁⒂,產品的操作使用方便性⒔⒕⒖⒗⒘⒙⒚⒛ⅠⅡⅢⅣⅤⅥⅦⅧⅨⅩⅪⅫⅰⅱ、所提供的除錯功能及方法ⅲⅳⅴⅵⅶⅷⅸⅹⒶⒷⒸⒹ,亦是決定產品好壞的重要因素⒜⒝⒞⒟⒠⒡⒢⒣⒤。
一個OCR識別系統⒜⒝⒞⒟⒠⒡⒢⒣⒤,其目的很簡單❻❼❽❾❿⓫⓬⓭⓮⓯⓰,只是要把影像作一個轉換✵✶✷✸✹✺✻✼❄❅,使影像內的圖形繼續保存㈧㈨㈩⑴⑵⑶⑷⑸⑹⑺⑻⑼⑽⑾⑿⒀⒁⒂、有表格則表格內資料及影像內的文字ⒺⒻⒼⒽⒾⒿⓀⓁⓂⓃⓄⓅⓆⓇⓈⓉ,一律變成計算機文字⑰⑱⑲⑳⓪⓿❶❷❸❹❺,使能達到影像資料的儲存量減少♀☿☼☀☁☂☄、識別出的文字可再使用及分析ⒺⒻⒼⒽⒾⒿⓀⓁⓂⓃⓄⓅⓆⓇⓈⓉ,當然也可節省因鍵盤輸入的人力與時間⒜⒝⒞⒟⒠⒡⒢⒣⒤。
從影像到結果輸出♦☜☞☝✍☚☛☟✌✽✾✿❁❃,須經過影像輸入ⓣⓤⓥⓦⓧⓨⓩ、影像前處理⒃⒄⒅⒆⒇⒈⒉⒊⒋⒌⒍⒎⒏⒐⒑⒒⒓、文字特征抽取⒥⒦⒧⒨⒩⒪⒫⒬⒭⒮⒯⒰⒱⒲⒳⒴⒵❆❇❈❉❊†☨✞✝☥☦☓☩☯、比對識別⑰⑱⑲⑳⓪⓿❶❷❸❹❺、最后經人工校正將認錯的文字更正⑰⑱⑲⑳⓪⓿❶❷❸❹❺,將結果輸出ⓣⓤⓥⓦⓧⓨⓩ。在此逐一介紹:
影象輸入:欲經過OCR處理的標的物須透過光學儀器❋❀⚘☑✓✔√☐☒✗✘ㄨ✕✖✖⋆✢✣,如影像掃描儀⑰⑱⑲⑳⓪⓿❶❷❸❹❺、傳真機或任何攝影器材♦☜☞☝✍☚☛☟✌✽✾✿❁❃,將影像轉入計算機㈠㈡㈢㈣㈤㈥㈦。科技的進步ⓣⓤⓥⓦⓧⓨⓩ,掃描儀等的輸入裝置已制作的愈來愈精致㊀㊁㊂㊃㊄㊅㊆㊇㊈㊉,輕薄短小❣❦❧♡۵、品質也高①②③④⑤⑥⑦⑧⑨⑩⑪⑫⑬⑭⑮⑯,對OCR有相當大的幫助ⓚⓛⓜⓝⓞⓟⓠⓡⓢ,掃描儀的分辨率使影像更清晰♦☜☞☝✍☚☛☟✌✽✾✿❁❃、掃除速度更增進OCR處理的效率ⓊⓋⓌⓍⓎⓏⓐⓑⓒⓓⓔⓕⓖⓗⓘⓙ。
影像前處理:影像前處理是OCR系統中㈠㈡㈢㈣㈤㈥㈦,須解決問題最多的一個模塊✤✥❋✦✧✩✰✪✫✬✭✮✯❂✡★✱✲✳✴,從得到一個不是黑就是白的二值化影像☧☬☸✡♁✙♆。,、':∶;,或灰階⒃⒄⒅⒆⒇⒈⒉⒊⒋⒌⒍⒎⒏⒐⒑⒒⒓、彩色的影像❻❼❽❾❿⓫⓬⓭⓮⓯⓰,到獨立出一個個的文字影像的過程✺ϟ☇♤♧♡♢♠♣♥,都屬于影像前處理♀☿☼☀☁☂☄。包含了影像正規化①②③④⑤⑥⑦⑧⑨⑩⑪⑫⑬⑭⑮⑯、去除噪聲✤✥❋✦✧✩✰✪✫✬✭✮✯❂✡★✱✲✳✴、影像矯正等的影像處理㊀㊁㊂㊃㊄㊅㊆㊇㊈㊉,及圖文分析♦☜☞☝✍☚☛☟✌✽✾✿❁❃、文字行與字分離的文件前處理⓱⓲⓳⓴⓵⓶⓷⓸⓹⓺⓻⓼⓽⓾。在影像處理方面⑰⑱⑲⑳⓪⓿❶❷❸❹❺,在學理及技術方面都已達成熟階段♦☜☞☝✍☚☛☟✌✽✾✿❁❃,因此在市面上或網站上有不少可用的鏈接庫⒔⒕⒖⒗⒘⒙⒚⒛ⅠⅡⅢⅣⅤⅥⅦⅧⅨⅩⅪⅫⅰⅱ;在文件前處理方面☈⊙☉℃℉❅,則憑各家本領了⒃⒄⒅⒆⒇⒈⒉⒊⒋⒌⒍⒎⒏⒐⒑⒒⒓;影像須先將圖片⑰⑱⑲⑳⓪⓿❶❷❸❹❺、表格及文字區域分離出來ⒺⒻⒼⒽⒾⒿⓀⓁⓂⓃⓄⓅⓆⓇⓈⓉ,甚至可將文章的編排方向☧☬☸✡♁✙♆。,、':∶;、文章的提綱及內容主體區分開㈠㈡㈢㈣㈤㈥㈦,而文字的大小及文字的字體亦可如原始文件一樣的判斷出來㈠㈡㈢㈣㈤㈥㈦。
文字特征抽取:單以識別率而言✵✶✷✸✹✺✻✼❄❅,特征抽取可說是 OCR的核心♦☜☞☝✍☚☛☟✌✽✾✿❁❃,用什么特征ⒺⒻⒼⒽⒾⒿⓀⓁⓂⓃⓄⓅⓆⓇⓈⓉ、怎么抽取☧☬☸✡♁✙♆。,、':∶;,直接影響識別的好壞⒔⒕⒖⒗⒘⒙⒚⒛ⅠⅡⅢⅣⅤⅥⅦⅧⅨⅩⅪⅫⅰⅱ,也所以在OCR研究初期ⓣⓤⓥⓦⓧⓨⓩ,特征抽取的研究報告特別的多❋❀⚘☑✓✔√☐☒✗✘ㄨ✕✖✖⋆✢✣。而特征可說是識別的籌碼㈧㈨㈩⑴⑵⑶⑷⑸⑹⑺⑻⑼⑽⑾⑿⒀⒁⒂,簡易的區分可分為兩類:一為統計的特征⑰⑱⑲⑳⓪⓿❶❷❸❹❺,如文字區域內的黑/白點數比☧☬☸✡♁✙♆。,、':∶;,當文字區分成好幾個區域時ⒺⒻⒼⒽⒾⒿⓀⓁⓂⓃⓄⓅⓆⓇⓈⓉ,這一個個區域黑/白點數比之聯合⒥⒦⒧⒨⒩⒪⒫⒬⒭⒮⒯⒰⒱⒲⒳⒴⒵❆❇❈❉❊†☨✞✝☥☦☓☩☯,就成了空間的一個數值向量⑰⑱⑲⑳⓪⓿❶❷❸❹❺,在比對時ⓣⓤⓥⓦⓧⓨⓩ,基本的數學理論就足以應付了ⓊⓋⓌⓍⓎⓏⓐⓑⓒⓓⓔⓕⓖⓗⓘⓙ。而另一類特征為結構的特征㈧㈨㈩⑴⑵⑶⑷⑸⑹⑺⑻⑼⑽⑾⑿⒀⒁⒂,如文字影像細線化后㊀㊁㊂㊃㊄㊅㊆㊇㊈㊉,取得字的筆劃端點ⒺⒻⒼⒽⒾⒿⓀⓁⓂⓃⓄⓅⓆⓇⓈⓉ、交叉點之數量及位置✺ϟ☇♤♧♡♢♠♣♥,或以筆劃段為特征ⒺⒻⒼⒽⒾⒿⓀⓁⓂⓃⓄⓅⓆⓇⓈⓉ,配合特殊的比對方法❋❀⚘☑✓✔√☐☒✗✘ㄨ✕✖✖⋆✢✣,進行比對ⓊⓋⓌⓍⓎⓏⓐⓑⓒⓓⓔⓕⓖⓗⓘⓙ,市面上的線上手寫輸入軟件的識別方法多以此種結構的方法為主⒔⒕⒖⒗⒘⒙⒚⒛ⅠⅡⅢⅣⅤⅥⅦⅧⅨⅩⅪⅫⅰⅱ。
對比數據庫:當輸入文字算完特征后☈⊙☉℃℉❅,不管是用統計或結構的特征⑰⑱⑲⑳⓪⓿❶❷❸❹❺,都須有一比對數據庫或特征數據庫來進行比對❻❼❽❾❿⓫⓬⓭⓮⓯⓰,數據庫的內容應包含所有欲識別的字集文字㊀㊁㊂㊃㊄㊅㊆㊇㊈㊉,根據與輸入文字一樣的特征抽取方法所得的特征群組㊀㊁㊂㊃㊄㊅㊆㊇㊈㊉。
對比識別:這是可充分發揮數學運算理論的一個模塊❣❦❧♡۵,根據不同的特征特性㈧㈨㈩⑴⑵⑶⑷⑸⑹⑺⑻⑼⑽⑾⑿⒀⒁⒂,選用不同的數學距離函數㈠㈡㈢㈣㈤㈥㈦,較有名的比對方法有㊀㊁㊂㊃㊄㊅㊆㊇㊈㊉,歐式空間的比對方法☧☬☸✡♁✙♆。,、':∶;、松弛比對法(Relaxation)①②③④⑤⑥⑦⑧⑨⑩⑪⑫⑬⑭⑮⑯、動態程序比對法(Dynamic Programming㊀㊁㊂㊃㊄㊅㊆㊇㊈㊉,DP)⒃⒄⒅⒆⒇⒈⒉⒊⒋⒌⒍⒎⒏⒐⒑⒒⒓,以及類神經網絡的數據庫建立及比對✵✶✷✸✹✺✻✼❄❅、HMM(Hidden Markov Model)…等著名的方法⓱⓲⓳⓴⓵⓶⓷⓸⓹⓺⓻⓼⓽⓾,為了使識別的結果更穩定✺ϟ☇♤♧♡♢♠♣♥,也有所謂的專家系統(Experts System)被提出⒜⒝⒞⒟⒠⒡⒢⒣⒤,利用各種特征比對方法的相異互補性⒃⒄⒅⒆⒇⒈⒉⒊⒋⒌⒍⒎⒏⒐⒑⒒⒓,使識別出的結果ⓊⓋⓌⓍⓎⓏⓐⓑⓒⓓⓔⓕⓖⓗⓘⓙ,其信心度特別的高✤✥❋✦✧✩✰✪✫✬✭✮✯❂✡★✱✲✳✴。
字詞后處理:由于OCR的識別率并無法達到百分之百✺ϟ☇♤♧♡♢♠♣♥,或想加強比對的正確性及信心值ⓚⓛⓜⓝⓞⓟⓠⓡⓢ,一些除錯或甚至幫忙更正的功能♀☿☼☀☁☂☄,也成為OCR系統中必要的一個模塊①②③④⑤⑥⑦⑧⑨⑩⑪⑫⑬⑭⑮⑯。字詞后處理就是一例ⒺⒻⒼⒽⒾⒿⓀⓁⓂⓃⓄⓅⓆⓇⓈⓉ,利用比對后的識別文字與其可能的相似候選字群中☾☽❄☃,根據前后的識別文字找出最合乎邏輯的詞⒃⒄⒅⒆⒇⒈⒉⒊⒋⒌⒍⒎⒏⒐⒑⒒⒓,做更正的功能✺ϟ☇♤♧♡♢♠♣♥。
字詞數據庫:為字詞后處理所建立的詞庫⒜⒝⒞⒟⒠⒡⒢⒣⒤。
人工校正:OCR最后的關卡♀☿☼☀☁☂☄,在此之前❣❦❧♡۵,使用者可能只是拿支鼠標ⅲⅳⅴⅵⅶⅷⅸⅹⒶⒷⒸⒹ,跟著軟件設計的節奏操作或僅是觀看✤✥❋✦✧✩✰✪✫✬✭✮✯❂✡★✱✲✳✴,而在此有可能須特別花使用者的精神及時間✤✥❋✦✧✩✰✪✫✬✭✮✯❂✡★✱✲✳✴,去更正甚至找尋可能是OCR出錯的地方♀☿☼☀☁☂☄。一個好的OCR軟件⒥⒦⒧⒨⒩⒪⒫⒬⒭⒮⒯⒰⒱⒲⒳⒴⒵❆❇❈❉❊†☨✞✝☥☦☓☩☯,除了有一個穩定的影像處理及識別核心ⅲⅳⅴⅵⅶⅷⅸⅹⒶⒷⒸⒹ,以降低錯誤率外⒔⒕⒖⒗⒘⒙⒚⒛ⅠⅡⅢⅣⅤⅥⅦⅧⅨⅩⅪⅫⅰⅱ,人工校正的操作流程及其功能☧☬☸✡♁✙♆。,、':∶;,亦影響OCR的處理效率ⓚⓛⓜⓝⓞⓟⓠⓡⓢ,因此ⅲⅳⅴⅵⅶⅷⅸⅹⒶⒷⒸⒹ,文字影像與識別文字的對照ⓣⓤⓥⓦⓧⓨⓩ,及其屏幕信息擺放的位置ⓣⓤⓥⓦⓧⓨⓩ、還有每一識別文字的候選字功能⑰⑱⑲⑳⓪⓿❶❷❸❹❺、拒認字的功能☈⊙☉℃℉❅、及字詞后處理后特意標示出可能有問題的字詞❣❦❧♡۵,都是為使用者設計盡量少使用鍵盤的一種功能✵✶✷✸✹✺✻✼❄❅。
結果輸出:看使用者用OCR到底為了什么㈠㈡㈢㈣㈤㈥㈦。有人只要文本文件作部份文字的再使用之用ⒺⒻⒼⒽⒾⒿⓀⓁⓂⓃⓄⓅⓆⓇⓈⓉ,只要一般的文字文件⒃⒄⒅⒆⒇⒈⒉⒊⒋⒌⒍⒎⒏⒐⒑⒒⒓、有人要漂漂亮亮的和輸入文件一模一樣⒜⒝⒞⒟⒠⒡⒢⒣⒤,所以有原文重現的功能㈠㈡㈢㈣㈤㈥㈦、有人注重表格內的文字☾☽❄☃,所以要和Excel等軟件結合✤✥❋✦✧✩✰✪✫✬✭✮✯❂✡★✱✲✳✴。
上一條:暫時沒有ⓊⓋⓌⓍⓎⓏⓐⓑⓒⓓⓔⓕⓖⓗⓘⓙ! 下一條:Windows XP系統進程