- Se käyttää edistynyttä OCR:ää asiakirjojen tekstin indeksointiin ja mahdollistaa kattavat haut tiedostonimestä riippumatta.
- Automatisoi organisointia merkintäsääntöjen, yhteyshenkilöiden ja sähköpostin tai valvottujen kansioiden kautta tapahtuvan tiedonkeruun avulla.
- Se otetaan käyttöön mieluiten Dockerin avulla, ja se vaatii laitteistoa, jolla on OCR-suorituskyky (vähintään 2 Gt RAM-muistia).
Oletko koskaan tuhlannut puolen aamupäivän etsien ikivanhaa vuokrasopimusta tai kuittia juuri hajonneesta kodinkoneesta? Luokittele dokumentit Paperless-ngx:ssä Se voisi olla hyvä ratkaisu.
Paperiton-ngx Se on avoimen lähdekoodin helmi, joka on suunniteltu muuttamaan dokumenttienhallintasi älykäs ja haettavissa oleva digitaalinen järjestelmäSe ei ole vain paikka PDF-tiedostojen tallentamiseen, vaan työkalu, joka mullistaa tapamme käsitellä dokumentteja. Se antaa meille mahdollisuuden unohtaa paperit aina kun laki sen sallii, ja keskittää kaiken yhteen paikkaan. Dedikoitu palvelin yksityisyyden ylläpitämiseksi.
Mikä tekee Paperless-ngx:stä niin tehokkaan?
Tämän sovelluksen todellinen taika piilee sen kyvyssä "lukea" tiedostoja. Kiitos sen OCR (optinen merkkien tunnistus)Järjestelmä ei ainoastaan tallenna tiedostoa, vaan se indeksoi kaiken sen sisältämän tekstin. Tämä tarkoittaa, että jos tarvitset Etsi tekstiä PDF-tiedostoista Paperless-ngx:n avullaOhjelmisto löytää dokumentin, vaikka tiedostonimi olisi satunnainen koodi, koska analysoi sisäistä sisältöä.
Paperless-ngx:ssä dokumenttien luokittelun lisäksi järjestelmässä on tapaan perustuva itseleimaaminen ja sääntöjä. Ajan myötä työkalu oppii, että jos asiakirjassa mainitaan vuokranantajasi, sen on oltava Luo automaattisia lajittelusääntöjä Paperless-ngx:ssä määrittääksesi otsikot "Asunto" ja "Sopimus", mikä säästää sinulta manuaalisen työn, joka syntyy skannaamiesi arkkien luokittelusta.
- Usean käyttäjän hallinta: Sen avulla voit luoda erilaisia profiileja tietyillä käyttöoikeuksilla, jolloin voit määrittää ryhmiä, jotka voivat vain lukea asiakirjoja ilman oikeutta muokata niitä.
- Keskustelukumppanit ja tyypit: Voit määrittää, kuka asiakirjan myöntää (kirjeenvaihtaja) ja mihin luokkaan se kuuluu (asiakirjan tyyppi), mikä tarkentaa hakusuodattimia.
- Mukautetut kentät: Tiedoista on mahdollista lisätä tiettyjä metatietoja, jotta niistä saa täyden hallinnan.
- Turvallinen jakaminen: Jaa asiakirjasi Paperless-ngx:n avulla Se mahdollistaa linkkien luomisen kolmansille osapuolille, jopa perustamalla käyttöoikeuden vanhenemispäivä.
Luokittele dokumentit Paperless-ngx:ssä
Asennus ja tekninen käyttöönotto
Dokumenttien luokittelun aloittamiseksi Paperless-ngx:ssä suositeltavin tapa on käyttää Docker ja Docker Composerkoska se pitää järjestelmän puhtaana ja yksinkertaistaa päivityksiä huomattavasti. Vaikka se on yhteensopiva useiden tietokantojen kanssa, sen käyttö PostgreSQL on ensisijainen vaihtoehto sen kestävyyden vuoksi, vaikka se tukee myös SQLiteä tai MariaDB:tä.
Laitteiston osalta, jos sinulla on Raspberry Pi, muista, että OCR-prosessi on vaativa. Vanhemmissa 32-bittisissä malleissa tai malleissa, joissa on rajoitetusti RAM-muistia, käsittely voi olla hidasta; tämä on normaalia. dokumentin käsittely kestää useita minuutteja prosessoinnissa. Sujuvan suorituskyvyn takaamiseksi ainakin 2 Gt RAM-muistia (4 Gt on ihanteellinen)kaksiydinprosessori ja ennen kaikkea SSD-levy, jotta tietokanta ei ole pullonkaula.
Käyttöönotto voidaan tehdä GitHubissa saatavilla olevan automaattisen skriptin avulla, joka opastaa käyttäjää asennustoiminnon läpi. On tärkeää säätää ympäristömuuttujia, kuten PAPERLESS_OCR_LANGUAGE asetettu arvoon "spa" espanjaksi ja oikea aikavyöhyke, jotta asiakirjojen päivämäärät ovat oikein.
Työnkulut ja automaatio
Yksi hyödyllisimmistä toiminnoista dokumenttien luokittelussa Paperless-ngx:ssä on kulutushakemisto (kulutuskansio)Se koostuu valvotusta kansiosta, johon järjestelmä käsittelee automaattisesti kaikki sinne sijoittamasi tiedostot. Tämä voidaan integroida verkkoskanneriin määrittämällä Samba-kansio, jolloin paperia voidaan siirtää skannerista digitaaliseen tiedostoon koskematta näppäimistöön.
Toinenkin menetelmä on mahdollinen: Yhdistämällä järjestelmän IMAP-palvelimeen Paperless-ngx voi skannata postilaatikon ja jos se löytää sähköpostin, jonka aihe on "lasku" tai joka on tietyltä lähettäjältä, se poimii liitteen ja... luokittelee automaattisesti sääntöjen mukaan ennalta määritelty.
Dokumenttien luokittelu Paperless-ngx:ssä: yleisiä kysymyksiä ja ongelmia
Joskus käyttäjät huomaavat, että alkuperäinen tiedostonimi (kuten IMG0001.pdf) säilyy dokumentin otsikossa. Tämän estämiseksi on suositeltavaa määrittää dynaamiset tallennuspolut jotka järjestävät tiedostot kiintolevylle asiakirjatyypin, kirjeenvaihtajan ja vuoden perusteella, vaikka sisäistä otsikkoa hallitaan verkkokäyttöliittymän kautta.
Jos huomaat, että OCR tuottaa lukukelvotonta tekstiä tai että asiakirjat juuttuvat jumiin "Käsittely"Ensimmäinen tehtävä on tarkistaa Ratkaisu OCR-ongelmiin Paperless-ngx:ssä ja varmista, että oikeat kielipaketit on asennettu. Jos haut eivät palauta tuloksia joukkomuutoksen jälkeen, suorita funktio asiakirjahakemiston uudelleenindeksointi Se yleensä ratkaisee ongelman.
Tämä itse isännöity ratkaisu syrjäyttää kalliit yritysten dokumenttienhallintajärjestelmät ja tarjoaa ilmaisen, yksityisen vaihtoehdon, joka yhdistää OCR:n tehon automatisoitujen työnkulkujen joustavuuteen. Näin kuka tahansa käyttäjä voi muuttaa kasan epäjärjestyksessä olevia papereita... tehokas, turvallinen ja helppokäyttöinen digitaalinen tietokanta miltä tahansa laitteelta.
Teknologiaan ja internet-asioihin erikoistunut toimittaja, jolla on yli kymmenen vuoden kokemus erilaisista digitaalisista medioista. Olen työskennellyt toimittajana ja sisällöntuottajana verkkokaupan, viestinnän, verkkomarkkinoinnin ja mainonnan yrityksissä. Olen myös kirjoittanut taloustieteen, rahoituksen ja muiden alojen verkkosivuille. Työni on myös intohimoni. Nyt artikkeleideni kautta Tecnobits, Yritän tutkia kaikkia uutisia ja uusia mahdollisuuksia, joita teknologian maailma tarjoaa meille joka päivä parantaaksemme elämäämme.