Stránka 1 z 1

Konverze textu se špatnou diakritikou z webarchive

Napsal: 20 kvě 2025, 07:08
od houmr
Již několikrát jsem tahal nějaké texty z již neexistujících stránek přes Webarchive, a texty s českou diakritikou obvykle vypadají dost nečitelně:
< Pøedchozí stránka | 1 2 3 4 5 6 7 8 9 10 11 | Další stránka >
Je nějaký program, kde bych mohl jen vyměnit písmo, ve kterém by byly v ASCII tabulce uloženy ty správné znaky, popř. kde bych si sám nadefinoval, které znaky se mají zaměnit za jaké?

Když čeští inženýři kdysi dávno upravovali teletext na háčky a čárky, byli natolik uvědomělí, že se ty české písmena snažili v tabulce umístit tak, aby se se jim původní symbol co nejvíce (í na místo šipky, š misto dolaru apod.), takže se to docela dobře dalo číst i na televizi ze západu.
To se bohužel o tomto "kódování" úplně dobře říct nedá, čte se to dost blbě...

Napsal: 20 kvě 2025, 07:42
od martinkopp
GPT ti to překoduje.
< Předchozí stránka | 1 2 3 4 5 6 7 8 9 10 11 | Další stránka >

Napsal: 20 kvě 2025, 08:12
od houmr
A nějaké jednoddušší offline řešení bez tý GePrTky by nebylo?

Napsal: 20 kvě 2025, 08:35
od pocitujlasku
nastavit v prehliadaci kodovu stranku na 1250? pripadne upravit zdrojovy text a tam to pridat?

Napsal: 20 kvě 2025, 10:41
od JirkaZ
houmr: co kdybys sem dal link na konkrétní soubor???

Napsal: 20 kvě 2025, 15:54
od martinkopp
houmr píše:A nějaké jednoddušší offline řešení bez tý GePrTky by nebylo?
Nic jednoduššího než ctrlC a ctrlV mne nenapadá.

Napsal: 21 kvě 2025, 12:10
od Mahoney
Notepad++, Programmer's notepad, Kate atd. ty všechny umí přepnout kódovou stránku. Kódové stránky pro střední Evropu jsou tři, Windows-1250, ISO 8859-2, UTF-8, stačí vložit a přepnout.

Napsal: 21 kvě 2025, 16:32
od nonius
Pokud se jedná o obyčejný textový soubor nebo HTML, tak by mohlo stačit ten soubor otevřít v nějakém prohlížeči nebo editoru a zvolit správné kódování.
Ještě se můžete setkat s kódováním CP852 (PC Latin-2) pro zápis českých znaků.
Pokud se ten text už převedl na něco jiného, mohlo dojít poškození a běžnými programy se to nemusí povést převést zpátky. Ten text, který jste tady uvedl, vypadá, jako by se to převedlo z ISO-8859-1 nebo Windows-1252 na UTF-8.

Napsal: 21 kvě 2025, 17:46
od rnbw
Povodna stranka bola asi vo Windows-1250 a nebolo to v hlavicke uvedene. Taketo paskvily robilo u nas mnoho ludi.

Napsal: 21 kvě 2025, 18:23
od lesana87
V prohlížeči Links se dá navolit Ignorovat informaci o kódové stránce a Předpokládat kódovou stránku.

Napsal: 23 kvě 2025, 14:00
od Razmir
https://ftfy.readthedocs.io/en/latest/

ftfy: fixes text for you

The goal of ftfy is to take in bad Unicode and output good Unicode, for use in your Unicode-aware code.

Napsal: 24 kvě 2025, 16:53
od asdf
Našel jsem něco podobného v prohlížeči Firefox. Zmáčkne se Alt, objeví se menu, vybere se Zobrazit, vybere se Opravit znakovou sadu textu. Jestli to funguje, nevím, ale trochu to s tím textem cvičilo, tak snad jo.