Stránka 2 z 3
Napsal: 25 led 2024, 16:50
od ec1045
EKKAR ...
Skenováno to mám v rozlišení 300DPI (kompromis mezi rozlišením rychlosti skenování a velikostí souborů) ano je to skenováno do .JPG a barevně (hromada čísel je dosti zažloutlá) jen je blbé že ten A3 skener na kterém jsem to skenoval je CIS … takže barvičky nic moc (což u ST ničemu nevadí). Nastavení pro skenování bylo na text, takže obrázky typu fotka částečně utrpěli, ale nemám problém, pokud se někdo těch uprav, ujme tak ty obrázky oskenovat znovu tak aby byly dobře čitelné (ono jich tam zas tak moc není).
Ty AR byli skenované původně, mám pocit jen 150DPI a to ještě jen jedno bitové takže to taky podle toho vypadalo, ty novější skeny jsou trochu lepší ale taky jedno bitově takže obrázky taky stoji za …Už jsem pár věcí skenoval, takže tak trochu tuším, co a jak aby to za něco stálo. Jinak 300DPI považuji za spodní hranici rozlišení při skenování ...
Nejlepší je, že nadáváš ani jsi ty skeny neviděl zvažuji zda ti něco vůbec na ukázku dle tvého výběru pošlu za předpokladu, že se ozveš přes SZ. Pak můžeš nadávat.
Napsal: 25 led 2024, 17:13
od EKKAR
Nenadávám na tvoje skeny - ano, protože jsem je ještě neviděl, ale nadávám na skeny Amára, který NĚKDO udělal tak, že by skutečně zasloužil nakopat. Ten dotyčnej se s tím vůbec nezabejval, prostě to napráskal jak mu to pod ruce přišlo, nasekal černobílý .jpg a ty rovnou bez dalších úprav překopával do .pdf. Ulehčil si práci, ale žádnýho kloudnýho výsledku nedosáhnul, možná trochu informační hodnoty - ale v těch jejich skenech jsou kolikrát i písmenka těžko čitelný, protože skener vzal v čb režimu povrchový nerovnosti tehdejšího papíru jako tvar znaku. Prostě je to zgarb. Nelam si tím hlavu, na tebe ta kritika nesměřovala, jen prostě konstatování, žes nezvolil zrovna tu nejlepší cestu, takžer MŮŽOU VZNIKNOUT problémy.
Jak dělám skeny já se můžeš podívat třeba
semhle - postup je barevnej sken do bmp v rozlišení 450-600dpi, poloautomatickej ořez na zvolenej formát, automatický čištění/zvýraznění barevnýho kontrastu, ručně korigovaný odfiltrování žlutejch/hnědejch tónů, opakovaný automatický zvýšení kontrastu, konverze do černobílýho .bmp, po další rychlý kontrole vzhledu komprese do .jpg, srovnání polohy stránek a teprve pak konečná konverze do .pdf. Výsledek vidíš.
Napsal: 25 led 2024, 17:20
od EKKAR
Hill píše:....On ten JPEG za to může, jen když se použije už k prvnímu uložení ze skeneru, při posledním už takový vliv nemá. Daleko víc se na obrázkách podepíše nesouhlas tiskařského rastru s rozlišením skeneru, a třeba i těch 72 dpi souhlasí, ale stačí o půl stupně pootočit předlohu a ze skenu se v 99 % případů stane neopravitelná záležitost, všem chytrým softwarovým nástrojům navzdory.
....
Jop, přesně tohle jsem měl na mysli - prostě prvotní sken NEDĚLAT do .jpg/.jpeg, kde to minimálně udělá "moaré", pokud to obrázek nezkurwí úplně. Sken do .bmp/.png s rozlišením 400-600dpi už totiž ten původní 50-70dpi rastr v obrázku dokáže "rozbít" a "rozmělnit" tak, že výsledek je dál reprodukovatelnej a následná konverze do .jpg už mu nevadí. Bohužel, tohle jsem se musel naučit sám doslova desítkama pokusnejch skenů nejrůznějších tiskovin, pokud vím, tak nikdo a nikde tuhle informaci nepublikuje - možná proto, aby se nikomu neusnadnilo případný kvalitní reprodukování "autorsky chráněnýho obsahu". Barevný skenování usnadňuje odstranění zažloutnutí, protože z barevnýho skenu jde odfiltrovat i tmavší hnědá, kterou jen 1b sken vezme jako černou - a neodstranitelně ji tak "vpálí" do užitečnýho informačního obsahu. I když je předloha jenom černobílá a i konečnej výsledek se ve finále udělá černobílej, je právě proto potřeba skenovat do barvy - i když surový skeny zaberou gigabyty a výsledek má pouhejch pár desítek (stovek) MByte, opravdu se to vyplatí.
Napsal: 25 led 2024, 17:56
od ec1045
Aha … jo ty AR jsou dost bídný. Já primárně skenuji tak aby byl dobře čitelný text a schémata to že obrázky utrpí … je to škoda ale zrovna v ST jich moc není krom obálek. U .JPG taky dost záleží jak je nastavená komprese tj. zda zvládá ostré přechody nebo ne. Na skenování časopisů jsem si pořídil A3 skener … ten nejlevnější i tak stál raketu, ty s CCD snímači stáli mám pocit 3x víc. Aneb jsem vždy číslo rozešil a skenoval vlastní A3 archy. Ovladač skeneru umí udělat horizontální nebo vertikální dělení obrázku ale někde je tam chyba a pro TIF to nedělá. Další věci co jsem si všiml tak pokud byli zapnuté jakékoli filtry tak výsledek stal za …
Ale i tak by mě zajímal tvůj názor na to co jsem zapáchal na tom A3 skeneru … jedno číslo mám i v 600DPI.
Napsal: 25 led 2024, 18:32
od EKKAR
Zkus něco z těch skenů vložit sem:
https://webshare.cz/#/ a třeba po SZ nebo i do postu sem v diskusi dát odkaz. Uvidíme, co se s tím bude dát podniknout.
Napsal: 26 led 2024, 09:17
od Hill
Včera jsem si u
xy1 vypůjčil pět kompletních ročníků HaZ (1967 - 1971), je toho 58 čísel a jedno dvojčíslo.
Skenoval jsem to v 600 dpi do TIFF, bylo to něco přes 100 MB na stránku, kolem 3 GB na časopis. Vyčistil jsem obraz papíru, monochromatické stránky odbarvil a převedl na PDF. Ukázka
Haz6701 ve 150 dpi (13 MB) a
téhož v 300 dpi (45,6 MB).
Bude toho tedy plnotučná dávka.
Jak jsem se zmiňoval o sklonu těch štočkových rastrů, je vidět, že i na jedné stránce je každý skloněný jinak, jak už jsem psal výše. Na to žádný nástroj nepomůže, leda naskenovat každý obrázek zvlášť (v co nejvyšším rozlišení, i když 1200 dpi by mělo stačit), srovnat horizont, aby tečky ležely v jedné řadě, a vložit zpět mezi text. Vzhledem k tomu, že skenování, úprava a konverze jednoho časopisu se nedá urychlit pod asi 5 hodin, by taková záchrana štočkového tisku prodloužila čas zpracování na čtyřnásobek, možná i víc (nejde to dělat dávkově, pěkně každá stránka a každý obrázek jednotlivě, protože každý jednotlivý oddíl na stránce vyžaduje jiné ruční nastavení), nemuseli bychom se dožít dokončení. A to jsem slíbil, že ty časopisy vrátím...
Doplňující otázka: vyšla HaZ nějaká už před rokem 1967 a v roce 1972?
Napsal: 26 led 2024, 10:39
od EKKAR
Já mám od včerejška stažený nějaký ty skeny v .jpg, ale už bylo pozdě, mrknu na to o víkendu.
Napsal: 26 led 2024, 11:15
od eleferner
Ne ze bych tu chtel delat dablova advokata, ale ty skeny Amar jsou zkratka poplatne dobe vzniku. Belza o tom tenkrat napsal polo-omluvny uvodnik, ze by je sice slo scanovat grayscale/barevne, ale velikost (a vypocetni narocnost zobrazeni) by byla nasobne vetsi. Jejich primarnim ucelem bylo zpristupneni sirokym masam, ne archivace "pro pristi generace".
Po pravde, u prevazne textoveho casaku je skutecne efektivnejsi pouzit 1-bitovou hloubku. PDF totiz umi 1-bitove obrazky ulozit velmi efektivne, nasobne efektivneji nez treba PNG. Jako snad jediny mainstreamovy format ma totiz implementovane CCITT a JBIG2 algoritmy. Oficialni Amaro scany pouzivaji prave CCITT, proto jsou tak male.
Nevyhodou PDF (treba oproti DJVU) je, ze grayscale a barevne zdroje umi ukladat jen jako TIFF a ruzne formy JPEGu. TIFF je obrovsky a JPEG je dojebe kompresnimi artefakty. Proto treba ten 150 dpi HaZ od Hilla vypada tak hnusne a blbe se cte (a bude na nem i blbe fungovat OCR). To i ta Amara se ctou lip. Hodne PDF programu to resi tak, ze zdrojovy scan rozbije na vice pod-obrazku a uklada je dle potreby - fotky jako JPEG, text jako CCITT/JBIG2. To je efektivnejsi z hlediska objemu souboru i zobrazeni textu, ale z takto rozbitych PDF uz nejde rekonstruovat puvodni scan. Nehodi se to tedy pro archivaci. Ale holt PDF pouzivaji vsichni, zatimco jeho konkurenti smeruji na smetiste technickych dejin.
Ja osobne se snazim maximum scanovat do JBIG2 a jen kde je to opravdu nezbytne, stranku ponechat grayscale/barevne. IMO nasim "ukolem" opravdu neni suplovat Ceskou digitalni knihovnu, na to jsou tam placeni jini a maji "krapet" lepsi vybaveni a vetsi uloziste. Akorat na ten HaZ nebo Sdelovacku holt muze dojit rada treba az za 10 let...
Napsal: 26 led 2024, 15:07
od EKKAR
Ty skeny Amár jsou hlavně tak odfláknutý, že mají na h0vno i tu informační hodnotu. Nejsou čitelný obsahy, protože byly s šedým podtiskem a skener je vzal jako černý, jsou zprasený fotky i obrazce DPS. Hlavně že si za placku účtovali a účtujou 4místnou částku. Přitom stačilo skenovat v 8bitový stupnici šedi ... Jenže to by musel někdo myslet hlavou a ne prdelí. Nějakej omluvnej úvodník je zbytečnej, doyebanou hodnotu to ničemu nevrátí. Docela by mě zajímalo, jestli si takhle doprasený skeny ten kdo to takhle odsouhlasil udělat, koupil i sám pro sebe ...
Napsal: 26 led 2024, 15:40
od eleferner
Nahodou jsem potkal byvaleho majitele "mych" HaZu. Pry je odebiral osobne a dusoval se mi, ze vic nez tech 5 rocniku nikdy nevyslo.
Napsal: 26 led 2024, 16:43
od ec1045
TIFF je kontejner a umí několik druhů kompresí, co si tak matně vybavuji BMP, CCITT2, JPG, ZIP, … těch kontejnerových formátu je víc jako třeba PDF, MKV, …
Ta komprese CCITT2 je původem z faxu nebo aspoň se tam používala. Je to výborná komprese, pokud stačí jen jednobitová hloubka. Například na výkresy, texty a podobně ale je potřeba dostatečné rozlišení, aby to nebylo kostrbaté. I při vyšším rozlišení z toho lezou velmi malé soubory, A0 výkres plný čar se vleze do cca 300-350KB.
JPG má několik nastavení kompresí a taky dost záleží jak moc se to s tou kompresí hrotí. Jedno z těch nastavení se tíká i ostrosti přechodů aneb jsou JPG kde je ostrý přechod (text) čistý a jiné mají něco jako stín … na těch je pak text absolutně nečitelný.
Fajn formát je PNG aneb bezztrátově komprimovaná bitmapa jenže ten není moc rozšířen … Používám ho na webu pro technické obrázky (náhledy schémat a pro DPS) a umí taktéž malé soubory a to barevně.
EKKERa se musím zastat aneb ty amára jsou fakt dost odfiknutá a to co vím, existují dvě verze jedna jakštač použitelná (ta lepší) a druhá je katastrofa. Na to amáro to chce minimálně 300DPI v odstínech šedi a ne jak tam někde píší že je to naskenováno ve vysokém rozlišení 150DPI a jednobitově. Ty skeny mi přijdou jako by to skenoval nějaký amatér doma v obýváku po večerech a s nechutí. Je pravdou, že tenkrát s tím byli větší starosti, aneb technika nebyla tak výkonná jako dnes, ale i tenkrát to šlo udělat lépe. Problém bude asi v tom, že by to stálo peníze … a co mám zkušenost tak jakmile něco stojí peníze tak je to neřešitelný problém.
Neskončí na konec tak že si ty amara naskenujeme dle vlastních představ …
Napsal: 26 led 2024, 17:11
od Hill
PNG používám, je to bezeztrátově komprimovaná bitmapa, ale skenery to nezajímá, o tomto formátu se se mnou žádná nehodlá bavit. Proto to naskenuji do TIFu (štočky nejméně v 600 dpi), pak hromadně zkonvertuji do PNG, což zmenší objem dat asi na polovinu, a začnu zpracovávat. Po vyčištění struktury papíru, omezení počtu barev, případně odbarvení spadne objem dat PNG souboru průměrně na pětinu (některé stránky dostanu až na desetinu).
A nakonec to PDF Creatorem zkusím sežvejkat na 150 dpi, když se zhorší čitelnost, sjedu to znovu do 300 dpi, to už v naprosté většině případů vyhoví, i když výsledný soubor vyjde 4x až 5x větší.
Napsal: 27 led 2024, 00:46
od EKKAR
Jenom pro ukázku, dám sem 2 verze skenu ST z roku 1953 od ec1045. Obě vycházejí z obrázku s původním rozměrem 2337 x 1646 ve formátu .jpg o datový velikosti cca 732kB. Abych se vešel do limitu 300kB pro přílohu sem do vlákna, bez "odbarvení" jsem musel obrázek zredukovat na rozměr 1402 x 988 - má asi 290kB. Když jsem ho ale předtím odbarvil (odfiltroval "teplý" hnědý tóny), na velikost 278kB ho stačilo zredukovat jen na rozměr 1986 x 1399 = má lepší rozlišení už jen sám o sobě. Pořád je ale mnohem líp čitelnej, než kdyby ho ec1045 skenoval přímo do čb .jpg, kde by se jako černý písmo a kresba zafixovaly i hnědý vady papíru - a žádná další filtrace už by je neodstranila. A samozřejmě vím, že Sdělovací technika se už tiskla na režnej, nebělenej papír kvalitou hodně připomínající novinovej. Pokud bych měl takhle upravit celej časopis, začnu na surovým skenu srovnáním vertikály na stránce, následovat bude ořez na pevně danej formát, zvednutí kontrastu, vybělení, detailní korekce a eliminace kazů, finální konverze na striktně čb verzi a finální převod na .pdf. Datovej objem se tak postupně v několika krocích zmenší zhruba o 50% a přesto se zlepší čitelnost. Ano, je to časově náročnější, protože nemám profi placenej grafickej soft, kterej by mi všecky ty úpravy zvládnul naráz a ještě třeba k tomu dávkově, takže musím obrázek po obrázku upravit v několika softech po sobě a všecko řídit vokoručně. Ale jde to i s free programovým vybavením, jen se musí chtít.
Napsal: 27 led 2024, 10:31
od ec1045
Jak se koukám tak se ten sken trochu nepovedl aneb místy nadzvednutá předloha od skla (plastu) skeneru, holt ten skener je CIS a hloubka ostrosti je nula. Dost jsem s tím bojoval, ale nakonec to nějak vychytal … doufám. To byl taky důvod, proč jsem to skenoval v rozešitém stavu. Ale jinak to dopadlo v mezích možností dobře … těch 300DPI je opravdu na hraně použitelnosti … 600DPI na tom skeneru A3 co mám je nechutně pomalé.
Ten papír byl podle mně bílý a časem zežloutl, aneb je kyselý, holt si někdo zjednodušil při výrobě práci. V jednom čísle je vidět že někomu něco ukáplo a v daném místě je papír bílý, ale zbytek je nažloutlí. Mám pocit, že je tam i někde číslo/a kde je část skoro bílá a část dosti nažloutlá … jiná várka papíru. Taky se mi povedlo zachránit nějakou kapitalistickou dokumentaci, ve které byl vložen kus místního papíru. Ten místní papír měl žloutenku jak kráva a v místech kde se dotíral té kapitalistické dokumentace je vidět, že taky chytá žlutý nádech.
Ano skenovat to v odstínech šedi nešlo aneb kvalita papíru.
Napsal: 27 led 2024, 10:41
od Crifodo
Hill píše:Jak jsem se zmiňoval o sklonu těch štočkových rastrů
tradiční v praxi osvědčený úhel natočení rastru jdnotlivých barev je
C=15 M=75 Y=0 K=45, ta černá je právě proto 45% aby jako nejvýraznější barva v diagonále nejkratší dráhou nekolidovala rušivě s hranou štočku, což naopak u žluté vadí nejmíň, takže může být rovnoběžně a nějaký ten schod v půlce rozměru není nápadný. Totéž se dodržuje i u samotných čb/ výtažků.
Dodržet totéž při skenování je prakticky neřešitelné, takže buď skenovat s nadbytkem rozlišení a defacto okopírovat původní rastr za cenu obrovského souboru, nebo naopak využít nějakou více méně chytrou funkci, kdy se autotypová síť rovnou rozostřením převede do šedé škály. Jak to dělá ve větší vzdálenosti oko s tiskovým rastrem. Photoshop na to má přímo filtr nazvaný "Chytré vyhlazení". Dojde tam ke ztrátě nějakých detailů, ale u dostatečně jemného rastru je to přijatelnější než kostrbaté moaré.
Ekkarem předložený vzorek má ještě zbytečně (pro čb schéma) ponechaných 24bit/pixel čili barvu. Obrázek pak má 280 kB/8MB v RAM.
Redukováním do 8bit hloubky=256 odstínů šedé se kvalita nezmění, data ubydou. Dalším zredukováním bitové hloubky na 4bit/16 odstínů šedé se linie a texty významně nepoškodí. Uložením do .png by ale narostla data, protože je tam hodně tónů mezi č/b v zachlupacených neostrých hranách- pokud předtím opatrně zvýšíme kontrast, eliminuje se (zbytečné) zachlupacení hran po jpg, obraz se vizuálně zostří a dá se uložit výhodně v 4bit png. Viz další vzorek který má 188 kB/1.33 MB v RAM.
https://www.studentske.cz/2010/10/16a-d ... brazu.html
Velmi polopatické vysvětlení rastrů a úhlů:
https://www.moravapress.cz/cs/blog/tisk ... rastr.html