<?xml version="1.0"?>
<feed xmlns="http://www.w3.org/2005/Atom" xml:lang="ca">
	<id>http://wiki.joanillo.org/index.php?action=history&amp;feed=atom&amp;title=Instal%C2%B7laci%C3%B3_HP_Deskjet_F2480</id>
	<title>Instal·lació HP Deskjet F2480 - Historial de revisió</title>
	<link rel="self" type="application/atom+xml" href="http://wiki.joanillo.org/index.php?action=history&amp;feed=atom&amp;title=Instal%C2%B7laci%C3%B3_HP_Deskjet_F2480"/>
	<link rel="alternate" type="text/html" href="http://wiki.joanillo.org/index.php?title=Instal%C2%B7laci%C3%B3_HP_Deskjet_F2480&amp;action=history"/>
	<updated>2026-08-30T10:59:40Z</updated>
	<subtitle>Historial de revisió per a aquesta pàgina del wiki</subtitle>
	<generator>MediaWiki 1.34.2</generator>
	<entry>
		<id>http://wiki.joanillo.org/index.php?title=Instal%C2%B7laci%C3%B3_HP_Deskjet_F2480&amp;diff=257374&amp;oldid=prev</id>
		<title>Joan: Es crea la pàgina amb «=Instal.lació= HP ho té molt organitzat el tema d'impressió en Linux: *http://hplipopensource.com/hplip-web/index.html  &lt;pre&gt; $ sudo chmod a+x hplip-3.10.9.run $ ./hpl...».</title>
		<link rel="alternate" type="text/html" href="http://wiki.joanillo.org/index.php?title=Instal%C2%B7laci%C3%B3_HP_Deskjet_F2480&amp;diff=257374&amp;oldid=prev"/>
		<updated>2018-05-30T18:39:59Z</updated>

		<summary type="html">&lt;p&gt;Es crea la pàgina amb «=Instal.lació= HP ho té molt organitzat el tema d&amp;#039;impressió en Linux: *http://hplipopensource.com/hplip-web/index.html  &amp;lt;pre&amp;gt; $ sudo chmod a+x hplip-3.10.9.run $ ./hpl...».&lt;/p&gt;
&lt;p&gt;&lt;b&gt;Pàgina nova&lt;/b&gt;&lt;/p&gt;&lt;div&gt;=Instal.lació=&lt;br /&gt;
HP ho té molt organitzat el tema d'impressió en Linux:&lt;br /&gt;
*http://hplipopensource.com/hplip-web/index.html&lt;br /&gt;
&lt;br /&gt;
&amp;lt;pre&amp;gt;&lt;br /&gt;
$ sudo chmod a+x hplip-3.10.9.run&lt;br /&gt;
$ ./hplip-3.10.9.run&lt;br /&gt;
&amp;lt;pre&amp;gt;&lt;br /&gt;
Escullo l'oopció d'instal.lació manual&lt;br /&gt;
&amp;lt;/pre&amp;gt;&lt;br /&gt;
=Escànner=&lt;br /&gt;
per escanejar una pàgina d'un llibre utilitzo ''XSane Image Scanner'' (ve per defecte amb Ubuntu 10.04)&lt;br /&gt;
&lt;br /&gt;
En el ''XSane Image Scanner'', adquireix una previsualització (es veu el histograma). Després de previsualitzar, ja podem escanejar.&lt;br /&gt;
&lt;br /&gt;
També es pot utilitzar el ''Simple Scan''.&lt;br /&gt;
&lt;br /&gt;
=OCR=&lt;br /&gt;
Software OCR:&lt;br /&gt;
&amp;lt;pre&amp;gt;&lt;br /&gt;
$ sudo apt-get install tesseract-ocr tesseract-ocr-spa&lt;br /&gt;
&amp;lt;/pre&amp;gt;&lt;br /&gt;
&lt;br /&gt;
XSane Image Scanner, escullo .TIFF com a fitxer de sortida (l'arxiu ha de ser .tif)&lt;br /&gt;
&amp;lt;pre&amp;gt;&lt;br /&gt;
tesseract - command line OCR tool&lt;br /&gt;
tesseract imagename outputbase [configfile] [-l &amp;lt;langid&amp;gt;]&lt;br /&gt;
imagename must be a TIF image with a .tif extension&lt;br /&gt;
outputbase is the text file created with the OCR output&lt;br /&gt;
&amp;lt;/pre&amp;gt;&lt;br /&gt;
Em trobo amb un Segment Fault&lt;br /&gt;
&amp;lt;pre&amp;gt;&lt;br /&gt;
$ tesseract out.tif out.txt -l spa&lt;br /&gt;
Tesseract Open Source OCR Engine&lt;br /&gt;
Segmentation fault&lt;br /&gt;
&amp;lt;/pre&amp;gt;&lt;br /&gt;
No és que estigui malament la instal.lació, és perquè les imatges que rep el OCR han de complir uns requisits:&lt;br /&gt;
&amp;lt;pre&amp;gt;&lt;br /&gt;
tesseract, versió 2.04-2&lt;br /&gt;
check_legal_image_size:Error:Only 1,2,4,5,6,8 bpp are supported:32&lt;br /&gt;
&amp;lt;/pre&amp;gt;&lt;br /&gt;
Es pot resoldre mirant com escanejo la foto:&lt;br /&gt;
&lt;br /&gt;
XSane Configuration:&lt;br /&gt;
*Marco Redueix les imatges de 16 bits a 8 bits&lt;br /&gt;
*Compressió de les imatges de 8 bits: sense compressió&lt;br /&gt;
&lt;br /&gt;
Ara sí:&lt;br /&gt;
&amp;lt;pre&amp;gt;&lt;br /&gt;
$ tesseract out.tif out.txt -l spa&lt;br /&gt;
Tesseract Open Source OCR Engine&lt;br /&gt;
&amp;lt;/pre&amp;gt;&lt;br /&gt;
He de ficar la resolució d'escaneig a tope, i tocar el contrast i la saturació per destacar el text per davant del fons. (resolució mínima: 75 no 'hi ha prou; resolució màxima 1200: és excessiu). Agafo el valor de 229. Resolucions grans pengen el programa. Tanmateix, el resultat de la conversió no és fantàstic i hi ha moltes coses a corregir.&lt;br /&gt;
&lt;br /&gt;
Hi ha la possibilitat de treballar amb el configfile a veure si es veuen millores.&lt;br /&gt;
&amp;lt;pre&amp;gt;&lt;br /&gt;
       configfile is a file of control parameters used for debugging or modifying tesseract's behaviour.  They are  stored  in&lt;br /&gt;
       /usr/share/tesseract-ocr/tessdata/configs/&lt;br /&gt;
&amp;lt;/pre&amp;gt;&lt;br /&gt;
Instal.lo gocr: és un altre programa de OCR i el que està integrat amb el ''XSane Image Scanner''. Però això es pot canviar a Preferències &amp;gt; Configuració &amp;gt; OCR, i fer que el tesseract sigui l'aplicació predeterminada.&lt;br /&gt;
&amp;lt;pre&amp;gt;&lt;br /&gt;
$ sudo apt-get install gocr&lt;br /&gt;
&amp;lt;/pre&amp;gt;&lt;br /&gt;
&lt;br /&gt;
=Finalment OCR amb tesseract=&lt;br /&gt;
&lt;br /&gt;
Imatge &amp;gt; Mode &amp;gt; Indexat &amp;gt; nombre màxim de colors: 256 (que es correspon a 8bpp)&lt;br /&gt;
&lt;br /&gt;
[ GIMP ] TIFF save cannot handle indexed images with alpha channel.&lt;br /&gt;
&lt;br /&gt;
es soluciona: Right click at Layer &amp;gt; Remove alpha channel &lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
El procediment per preparar la imatge escanejada amb gimp i practicar el OCR amb tesseract és:&lt;br /&gt;
#tinc la imatge amb TIFF, capturada a la màxima resolució en el scànner&lt;br /&gt;
#L'obro amb GIMP&lt;br /&gt;
#sobre la capa, amb el botó dret, eliminar el Canal ALFA&lt;br /&gt;
#elimino imatges, línies, ombres negres,...&lt;br /&gt;
#Colors &amp;gt; Brillantor-contrast. Augmento el contrast&lt;br /&gt;
#Imatge &amp;gt; Mode &amp;gt; Indexat &amp;gt; Redueixo a 1 bit (el màxim que permet tesseract és 8 bits (256 colors))&lt;br /&gt;
#Grabo com a tif (extensió .tin, no .tiff), sense compressió&lt;br /&gt;
&amp;lt;pre&amp;gt;&lt;br /&gt;
$ tesseract pag3.tif pag3.txt -l spa&lt;br /&gt;
&amp;lt;/pre&amp;gt;&lt;br /&gt;
l'opció -l spa, té poc efecte. És més important la qualitat i el tipus de lletra. tesseract pot fer un entrenament, però això ja és una altra història.&lt;br /&gt;
=Impressió a pdf=&lt;br /&gt;
&lt;br /&gt;
Per concatenar pdf'x: pdftk:&lt;br /&gt;
&amp;lt;pre&amp;gt;&lt;br /&gt;
$ sudo aptitude install pdftk&lt;br /&gt;
&lt;br /&gt;
$ pdftk article1.pdf article2.pdf article3.pdf article4.pdf article5.pdf article6.pdf article7.pdf article8.pdf article9.pdf article10.pdf article11.pdf article12.pdf article13.pdf article14.pdf article15.pdf cat output article.pdf&lt;br /&gt;
&amp;lt;/pre&amp;gt;&lt;br /&gt;
{{Autor}}, octubre 2010&lt;/div&gt;</summary>
		<author><name>Joan</name></author>
		
	</entry>
</feed>