A. 誰有全文字手打小說網站地址
逐浪小說網無論是發表作品還是閱讀下載都很不錯,一般人偶不告訴他!!
B. 手打小說小說網
我經常看復的www.YRTXT.COM
純文字手制打!沒有圖片章節!更新速度保證!我看書基本都是在這看!電子書下載也是!不用注冊無廣告!那叫爽啊!樓上說的太多圖片章節了!不能下手機看的!而且電腦看著也不爽!
C. 手打小說網,手打吧怎麼了關了
最近由於起點的防盜版做的比較嚴重,所以手打少了。如果你看的小說比較受歡迎,可以去貼吧看看,貼吧會組織人手打。
D. 有沒有好的手打小說網站啊。下手機上看,
大眾小說網
找小說網
酷小牛小說網
這三個不用注冊 直接下載 不過更新慢 量比較少
望採納~!!!!!!!!!!!!
E. 純手打小說網站,那些VIP章節要手打的,不要截圖的網站
想看哪一本小說,就進它的貼吧!裡面每天都有人手打更新,比如凡人修仙傳吧
F. 手打小說網站的手打工作是怎麼做的
用的是OCR軟體
就是說這個軟體可以識別掃描儀掃描後圖片中的文字,將圖片轉化為文本。
所謂OCR (Optical Character Recognition光學字元識別)技術,是指電子設備(例如掃描儀或數碼相機)檢查紙上列印的字元,通過檢測暗、亮的模式確定其形狀,然後用字元識別方法將形狀翻譯成計算機文字的過程;即,對文本資料進行掃描,然後對圖像文件進行分析處理,獲取文字及版面信息的過程。
由於OCR是一門與識別率拔河的技術,因此如何除錯或利用輔助信息提高識別正確率,是OCR最重要的課題,ICR(Intelligent Character Recognition)的名詞也因此而產生。而根據文字資料存在的媒體介質不同,及取得這些資料的方式不同,就衍生出各式各樣、各種不同的應用。
一、OCR的發展
要談OCR的發展,早在60、70年代,世界各國就開始有OCR的研究,而研究的初期,多以文字的識別方法研究為主,且識別的文字僅為0至9的數字。以同樣擁有方塊文字的日本為例,1960年左右開始研究OCR的基本識別理論,初期以數字為對象,直至1965至1970年之間開始有一些簡單的產品,如印刷文字的郵政編碼識別系統,識別郵件上的郵政編碼,幫助郵局作區域分信的作業;也因此至今郵政編碼一直是各國所倡導的地址書寫方式。
OCR可以說是一種不確定的技術研究,正確率就像是一個無窮趨近函數,知道其趨近值,卻只能靠近而無法達到,永遠在與100%作拉鋸戰。因為其牽扯的因素太多了,書寫者的習慣或文件印刷品質、掃描儀的掃描品質、識別的方法、學習及測試的樣本……等等,多少都會影響其正確率,也因此, OCR的產品除了需有一個強有力的識別核心外,產品的操作使用方便性、所提供的除錯功能及方法,亦是決定產品好壞的重要因素。
一個OCR識別系統,其目的很簡單,只是要把影像作一個轉換,使影像內的圖形繼續保存、有表格則表格內資料及影像內的文字,一律變成計算機文字,使能達到影像資料的儲存量減少、識別出的文字可再使用及分析,當然也可節省因鍵盤輸入的人力與時間。
從影像到結果輸出,須經過影像輸入、影像前處理、文字特徵抽取、比對識別、最後經人工校正將認錯的文字更正,將結果輸出。
在此逐一介紹:
影像輸入:
欲經過OCR處理的標的物須透過光學儀器,如影像掃描儀、傳真機或任何攝影器材,將影像轉入計算機。科技的進步,掃描儀等的輸入裝置已製作的愈來愈精緻,輕薄短小、品質也高,對OCR有相當大的幫助,掃描儀的解析度使影像更清晰、掃除速度更增進OCR處理的效率。
影像前處理:影像前處理是OCR系統中,須解決問題最多的一個模塊,從得到一個不是黑就是白的二值化影像,或灰階、彩色的影像,到獨立出一個個的文字影像的過程,都屬於影像前處理。包含了影像正規化、去除雜訊、影像矯正等的影像處理,及圖文分析、文字行與字分離的文件前處理。在影像處理方面,在學理及技術方面都已達成熟階段,因此在市面上或網站上有不少可用的鏈接庫;在文件前處理方面,則憑各家本領了;影像須先將圖片、表格及文字區域分離出來,甚至可將文章的編排方向、文章的提綱及內容主體區分開,而文字的大小及文字的字體亦可如原始文件一樣的判斷出來。
文字特徵抽取:單以識別率而言,特徵抽取可說是 OCR的核心,用什麼特徵、怎麼抽取,直接影響識別的好壞,也所以在OCR研究初期,特徵抽取的研究報告特別的多。而特徵可說是識別的籌碼,簡易的區分可分為兩類:一為統計的特徵,如文字區域內的黑/白點數比,當文字區分成好幾個區域時,這一個個區域黑/白點數比之聯合,就成了空間的一個數值向量,在比對時,基本的數學理論就足以應付了。而另一類特徵為結構的特徵,如文字影像細線化後,取得字的筆劃端點、交叉點之數量及位置,或以筆劃段為特徵,配合特殊的比對方法,進行比對,市面上的線上手寫輸入軟體的識別方法多以此種結構的方法為主。
對比資料庫:當輸入文字算完特徵後,不管是用統計或結構的特徵,都須有一比對資料庫或特徵資料庫來進行比對,資料庫的內容應包含所有欲識別的字集文字,根據與輸入文字一樣的特徵抽取方法所得的特徵群組。
對比識別:
這是可充分發揮數學運算理論的一個模塊,根據不同的特徵特性,選用不同的數學距離函數,較有名的比對方法有,歐式空間的比對方法、鬆弛比對法(Relaxation)、動態程序比對法(Dynamic Programming,DP),以及類神經網路的資料庫建立及比對、HMM(Hidden Markov Model)…等著名的方法,為了使識別的結果更穩定,也有所謂的專家系統(Experts System)被提出,利用各種特徵比對方法的相異互補性,使識別出的結果,其信心度特別的高。
字詞後處理:由於OCR的識別率並無法達到百分之百,或想加強比對的正確性及信心值,一些除錯或甚至幫忙更正的功能,也成為OCR系統中必要的一個模塊。字詞後處理就是一例,利用比對後的識別文字與其可能的相似候選字群中,根據前後的識別文字找出最合乎邏輯的詞,做更正的功能。
字詞資料庫:為字詞後處理所建立的詞庫。
人工校正:
OCR最後的關卡,在此之前,使用者可能只是拿支滑鼠,跟著軟體設計的節奏操作或僅是觀看,而在此有可能須特別花使用者的精神及時間,去更正甚至找尋可能是OCR出錯的地方。一個好的OCR軟體,除了有一個穩定的影像處理及識別核心,以降低錯誤率外,人工校正的操作流程及其功能,亦影響OCR的處理效率,因此,文字影像與識別文字的對照,及其屏幕信息擺放的位置、還有每一識別文字的候選字功能、拒認字的功能、及字詞後處理後特意標示出可能有問題的字詞,都是為使用者設計盡量少使用鍵盤的一種功能,當然,不是說系統沒顯示出的文字就一定正確,就像完全由鍵盤輸入的工作人員也會有出錯的時候,這時要重新校正一次或能允許些許的錯,就完全看使用單位的需求了。
結果輸出:
其實輸出是件簡單的事,但卻須看使用者用OCR到底為了什麼?有人只要文本文件作部份文字的再使用之用,所以只要一般的文字文件、有人要漂漂亮亮的和輸入文件一模一樣,所以有原文重現的功能、有人注重表格內的文字,所以要和Excel等軟體結合。無論怎麼變化,都只是輸出檔案格式的變化而已。如果需要還原成原文一樣格式,則在識別後,需要人工排版,耗時耗力。
二、中文OCR
中文OCR,光學符號識別技術是一種漢字文稿的自動輸入方式,它通過光學掃描儀和計算機的配合,經OCR軟體將圖像數據進行運算分類後,將圖像數據轉化為計算機內碼,可以極大減輕數據錄入工作的強度,提高數據錄入的速度。
文獻資料的數字化錄入,一般分為:
1、純圖像方式。
2、目錄文本、正文圖像方式。
3、全文本方式。
4、全文索引方式。文本方式和圖像方式的混合體。
我國在OCR技術方面的研究工作起步較晚,在70年代才開始對數字、英文字母及符號的識別進行研究,70年代末開始進行漢字識別的研究,到1986年漢字識別的研究進入一個實質性的階段,不少研究單位相繼推出了中文OCR產品.
我國目前使用的文本型OCR軟體主要有清華文通TH-OCR、北信BI-OCR、中自ICR、沈陽自動化所SY-OCR、北京曙光公司NI-OCR(已被中自漢王並購)等,匹配的掃描儀則使用市面上的平板掃描儀。
三、衡量OCR標准
衡量一個OCR系統性能好壞的主要指標有:拒識率、誤識率、識別速度、用戶界面的友好性,產品的穩定性,易用性及可行性等方面。
四、OCR工作原理
識別過程:
書本級:中文,英文;簡體,繁體;
版式級:豎排,橫排;有無分欄;
行切分
字切分
識別:真正的OCR識別過程,圖像信息還原成文本信息
後處理:人工干預,主要集中在前四個階段。
識別精度可以達到99%
五:OCR識別率取決於
1.圖片的質量,一般建議150dpi以上
2.顏色,一般對彩色識別很差,黑白的圖片較高,因此建議ocr的為黑白tif格式
3.最重要的就是字體,如果是手寫識別率很低。
國內OCR識別簡體差錯率為萬分之三,如果要求更高的精度需要投入更大的人工干預。繁體識別由於繁體字型檔的不統一性(民國時期的字型檔和現在繁體字型檔不統一),導致識別困難,在人工干預下,精度能達到90%以上(圖文清晰情況下)。
OCR是計算機輸入技術的一種,它通過模式識別將文字的圖像文件轉化為可編輯的文本文件,徹底改變了計算機紙介質資料輸入的概念。只要用掃描儀將文本圖像輸入計算機,就可轉化為可修改的文本文件,這比手工輸入速度快了幾十倍。隨著OCR技術的廣泛應用,它正逐漸被人們所知曉。國際軟體巨頭微軟在研發XP系統的時候,就意識到OCR的市場需求,在發布的Office 2003中全面配裝了TH-OCR(北京文通信息技術有限公司開發);硬體方面的領袖企業英特爾公司也確定TH-OCR為MMX技術支持項目。
近期,一些大公司意識到OCR的好處,開始在自己的產品中捆綁OCR技術。Google已經啟動OCR軟體的開發工作,在它的招聘啟示中這樣寫道:「Google currently "reads" almost every web page in the world. Come help us read all the printed material as well!」(Google現在已經能夠「閱讀」世界上幾乎所有網頁,你的到來將讓Google閱讀所有印刷信息!)。隨著google啟動OCR開發工作,OCR應用進入了全面爆發時代。
無論是讓計算機對文字進行排版輸出,還是要讓計算機認識它看到文字,所有這一切都是為我們生活服務。信息化和數字化的進程,讓我們不再安於用十指敲擊鍵盤來輸入數據。人們希望能將時間和精力投入到更具創造性的工作中去,因而希望計算機等輔助設備能更具智慧。OCR(Optical Character Recognition,光學字元識別)技術就是其中的一項,跟列印技術相對,它是讓計算機認字的一種技術,這遠比列印復雜得多。
經濟競爭帶來更多的商務活動,每個活動上名片都是必不可少的主角,名片的管理產品也應運而生,名片識別管理工具同樣也是以OCR技術為核心的產品。通過名片識別工具將名片進行掃描、識別、分類,不僅能夠導入手機、PDA等,而且還能為名片信息進行備份,不用擔心遺失。文通e-card就是一款優秀的名片識別管理產品,OCR技術能把商務生活打理得有條不紊,節約更多的時間。現在,幾乎所有的掃描儀和一體機上都配裝OCR軟體,比如HP、UNISCAN、EPSON、CANON、 LENOVO等掃描儀廠商捆綁的就是文通TH-OCR。
G. 手打小說網怎麼都是圖片格式的了
因為最近起抄點修改了VIP閱讀的格式,導致很多手打網站都無法發布文字版小說了。現在手打小說網正在啟用手打小組,讓大家一起幫忙手打最新的小說信息。近3天內應該就可以恢復成全文字的了。你還是在等等吧。
現在幾乎所有站點都是圖片章節的了。
手打吧 閱讀地址 www.shouda8.com
H. 請推薦一個全文字全手打的小說網
手打小說網:http://www.yinsi8.com
不錯,我一直在這個網站上看小說,不用注內冊,更新及容時
I. 手打小說網站哪個最好
我喜歡去派派小說論壇
然後就是小說之家itxtbook
J. 全手打小說網站
逆龍道小說網,快眼看書