Textnizer - Sprievodca

Extrahujte text z reči, snímok obrazovky a súborov. Podporuje rozpoznávanie reči v reálnom čase, OCR snímok obrazovky a dávkové spracovanie zvuku, videa, obrázkov a PDF.


Začíname

Vyberte jeden z troch režimov na hlavnej obrazovke:

  1. Live Transcription — prevod reči na text v reálnom čase z mikrofónu
  2. Capture Transcription — OCR zo snímok obrazovky alebo kamery
  3. File Transcription — dávkové spracovanie zvukových, video, obrázkových alebo PDF súborov

Live Transcription

Rozpoznávanie reči v reálnom čase z mikrofónu alebo zvukového vstupného zariadenia.

Hlasové moduly

ModulTypNajlepší pre
Google SpeechOnline APIVysoká presnosť, mnoho jazykov (predvolený)
WhisperLokálny modelOffline použitie, súkromie (modely tiny až large)
VoskOfflineĽahký, rýchly, mnoho jazykov

Možnosti nahrávania

  • Výber zvukového vstupného zariadenia
  • Audio Format: MP3 alebo WAV
  • Audio Quality: low / medium / high
  • Voliteľné nahrávanie videa s náhľadom kamery
  • Voliteľná Speaker Classification (rozlišuje rôznych rečníkov)

Capture Transcription

Extrahujte text zo snímok obrazovky alebo z kamery pomocou OCR.

  • Camera capture — vyberte zariadenie kamery, urobte jednotlivú snímku
  • Full screen capture — zachyťte celú obrazovku
  • Region selection — nakreslite obdĺžnik na zachytenie konkrétnej oblasti
  • Window capture — zachyťte konkrétne okno

OCR modul: Tesseract (predvolená japončina). Výsledky sa zobrazujú vedľa zachyteného obrázka.


File Transcription

Spracujte súbory dávkovo presunutím alebo pomocou prehliadača súborov.

Podporované formáty

TypFormátyMetóda
ZvukMP3, WAV, M4A, FLAC, AAC, OGG, WMAHlasový modul
VideoMP4, AVI, MOV, MKV, WMV, FLVExtrakcia zvuku → hlasový modul
ObrázokJPG, PNG, BMP, TIFF, GIFTesseract OCR
DokumentPDFStrana → obrázok → OCR

Workset History

  • Každá relácia prepisu sa ukladá ako workset
  • Filtrujte podľa kľúčového slova, typu (Live/Capture/File) a stavu
  • Dvojklikom znova otvoríte predchádzajúcu reláciu
  • Triediteľné stĺpce: názov, typ, metóda, dátum, stav

Nastavenia

NastaveniePopisPredvolené
Recognition ModelPredvolený hlasový modulGoogle
Audio FormatFormát nahrávaniaWAV
Audio QualityÚroveň kompresieMedium
Video CapturePovoliť nahrávanie z kameryOff
Speaker ClassificationIdentifikácia rôznych rečníkovOff

Tipy

  • Offline prepis — Použite Whisper alebo Vosk pre úplne offline rozpoznávanie reči
  • Poznámky zo stretnutí — Zapnite Speaker Classification na rozlíšenie, kto čo povedal
  • Dávkové OCR — Presuňte celý priečinok skenovaných dokumentov na dávkové spracovanie
  • Extrakcia PDF — Každá strana PDF sa prevedie na obrázok a OCR sa spracuje samostatne

Súkromie

  • Moduly Whisper a Vosk bežia úplne na vašom zariadení
  • Google Speech odosiela zvuk na servery Google na rozpoznanie
  • Všetky výsledky prepisu a nahrávky sú uložené iba na vašom lokálnom disku
  • Žiadna analytika ani sledovanie