देवनागरी · तिरहुता · English — local OCR engine/model रहला पर offline चलत
⚠️ OCR गुणवत्ता चेतावनी: cover, poster, photo-background, border, QR/barcode, decorative page पर OCR बहुत खराब हो सकैत अछि। साफ किताब-पन्ना/typed text page पर चलाउ। Cover/graphics लेल पहिले page range सँ ओ पन्ना छोड़ू वा नीचे “Sparse/cover text” preset चुनू।
पहिल विकल्प साफ पन्ना लेल अछि। Cover मे सजावट/रेखा/चित्र केँ अक्षर बुझि OCR बिगड़ैत अछि।
Mixed page पर केवल “hin” नहि चुनू; English + Devanagari चुनू। Tirhuta लेल genuine tirhuta.traineddata.gz चाही — tir Tigrinya अछि।
Same code as traineddata filename(s), without .traineddata.gz
Cover छोड़य लेल 2- लिखू। खाली छोड़ू = सभ पन्ना।
150 DPI
साफ printed page पर threshold नीक; cover/graphics पर none/gray नीक।
Book page लेल 6/4; cover/poster लेल 11 कोशिश करू।
Cover/poster मे सजावट आ QR/barcode हटाबय लेल केवल असली text क्षेत्र OCR करू। Whole cover OCR करब बेसीतर खराब होयत।
TopRightBottomLeft
OCR output मे blank lines/extra spaces साफ करू
👁️ Improved offline OCR: v20 मे reusable OCR worker, image-preprocessing, layout presets, आ Crop/Zone जोड़ल गेल अछि। Cover/poster पर पूरा पन्ना नहि, केवल text क्षेत्र OCR करू। Expected local files: assets/ocr/tesseract.min.js, worker.min.js, tesseract-core.wasm.js, and assets/ocr/lang/eng.traineddata.gz / hin.traineddata.gz / Devanagari.traineddata.gz. For Tirhuta use custom assets/ocr/lang/tirhuta.traineddata.gz. OCR लेल localhost सँ खोलू। Direct file:// खोलला पर worker/WASM fail भऽ सकैत अछि।
✂️
PDF केँ पन्ना वा size अनुसार बाँटू · Split PDF by pages or approximate size
No artificial file-size cap; practical capacity depends on browser RAM/device power.
Page split exact अछि। Size split browser-rendered PDF मे approximate अछि, कारण output size image quality/DPI पर निर्भर करैत अछि।
Semicolon अलग output file बनायत।
उदाहरण: 10 = 1-10, 11-20...
Approximate batching; exact MB guarantee नहि।
130 DPI
82%
⚠️ Split output एहि browser tool मे rendered/raster PDF होयत; searchable text layer सुरक्षित नहि रहि सकैत अछि। Unlimited capacity = code limit नहि, browser/device memory limit लागू।
🧩
PDF, PNG, JPG जोड़ि एक PDF बनाउ · Merge PDF/images into one PDF
Drag files, reorder, then merge. No artificial count/size limit; browser memory applies.
130 DPI
82%
PDF pages are rendered; image files are placed as pages.
⚠️ PDF merge एहि standalone version मे rasterizes PDF pages through canvas. Use lower DPI for very large files.
🖼️
PNG/JPG split, merge, PDF बनाउ · Image split/merge/convert
Multiple PNG/JPG files; output ZIP or one merged file/PDF.
rowscolumns
widthheight
JPG/PNG for split or merged image; PDF makes one PDF from selected images.
88%
Large image merge/split uses browser canvas; very large panoramas may exceed browser canvas memory.
▶️ Standalone browser HTML YouTube सँ audio directly download/convert नहि कऽ सकैत, कारण YouTube restrictions/CORS आ copyright/terms issues। ई panel केवल authorized workflow, URL checking, notes, आ external lawful conversion reminder लेल अछि।
Maithili speech recognition browser मे प्रायः native नहि; mai-IN fail भेल त hi-IN fallback कोशिश करू।
Chrome/Edge मे Web Speech API online service प्रयोग कऽ सकैत अछि; offline guarantee नहि।
MP3/WAV/M4A/OGG चुनू; फाइल local preview लेल रहत।
Direct audio-file transcription browser Web Speech API मे उपलब्ध नहि; Start दबा कऽ audio play करब त mic सँ सुनल आवाज transcribe भऽ सकैत अछि।
Ready. Browser support required. Audio upload preview added.