<?xml version="1.0" encoding="UTF-8"?>
<rss xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:taxo="http://purl.org/rss/1.0/modules/taxonomy/" version="2.0">
  <channel>
    <title>topic OCR + Alfresco in Alfresco Archive</title>
    <link>https://connect.hyland.com/t5/alfresco-archive/ocr-alfresco/m-p/42820#M23180</link>
    <description>&lt;HTML&gt;&lt;HEAD&gt;&lt;/HEAD&gt;&lt;BODY&gt;&lt;SPAN&gt;Bonjour,&lt;/SPAN&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;SPAN&gt;Voila mon problème meta physique.&lt;/SPAN&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;SPAN&gt;J'ai tout le necessaire pour numériser un document, le convertir en PDF et le déposer dans alfresco. J'ai aussi une interface a qui me permet de saisie en amont les meta donnée.&lt;/SPAN&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;SPAN&gt;Maintenant je réalise un OCR de l'image, j'obtiens un flux texte et mon image . Tout ça avant l'intégration dans alfresco.&lt;/SPAN&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;SPAN&gt;Voici mon dilem, je trouve préférable d'injecter le document PDF tel qu'il provient du scanner pour garder la mise en forme en autre. Mais j'aimerais pouvoir faire une recherche sur le contenu donc le flux texte provenant de l'OCR.&lt;/SPAN&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;SPAN&gt;Alors j'ai bien pensé mettre le flux texte dans une meta donnée, mais si mon doc fait 15 ou 50 pages le flux va être énorme et j'ai peur du résultat pour la base et le temps de recherche.&lt;/SPAN&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;SPAN&gt;Avez vous un avis, ou mieux un retour d'expérience.&lt;/SPAN&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;SPAN&gt;Merci&lt;/SPAN&gt;&lt;/BODY&gt;&lt;/HTML&gt;</description>
    <pubDate>Tue, 04 Mar 2008 14:57:43 GMT</pubDate>
    <dc:creator>hlander10</dc:creator>
    <dc:date>2008-03-04T14:57:43Z</dc:date>
    <item>
      <title>OCR + Alfresco</title>
      <link>https://connect.hyland.com/t5/alfresco-archive/ocr-alfresco/m-p/42820#M23180</link>
      <description>Bonjour,Voila mon problème meta physique.J'ai tout le necessaire pour numériser un document, le convertir en PDF et le déposer dans alfresco. J'ai aussi une interface a qui me permet de saisie en amont les meta donnée.Maintenant je réalise un OCR de l'image, j'obtiens un flux texte et mon image . To</description>
      <pubDate>Tue, 04 Mar 2008 14:57:43 GMT</pubDate>
      <guid>https://connect.hyland.com/t5/alfresco-archive/ocr-alfresco/m-p/42820#M23180</guid>
      <dc:creator>hlander10</dc:creator>
      <dc:date>2008-03-04T14:57:43Z</dc:date>
    </item>
    <item>
      <title>Re: OCR + Alfresco</title>
      <link>https://connect.hyland.com/t5/alfresco-archive/ocr-alfresco/m-p/42821#M23181</link>
      <description>&lt;HTML&gt;&lt;HEAD&gt;&lt;/HEAD&gt;&lt;BODY&gt;&lt;SPAN&gt;Je n'ai jamais mis en oeuvre ce genre de technologies à titre personnel, en revanche il existe des pages sur le wiki basées sur Kofax. &lt;/SPAN&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;A href="http://wiki.alfresco.com/wiki/Kofax_Release_Script" rel="nofollow noopener noreferrer"&gt;http://wiki.alfresco.com/wiki/Kofax_Release_Script&lt;/A&gt;&lt;BR /&gt;&lt;A href="http://wiki.alfresco.com/wiki/Image_Management" rel="nofollow noopener noreferrer"&gt;http://wiki.alfresco.com/wiki/Image_Management&lt;/A&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;SPAN&gt;Peut être cela vous donnera de plus amples informations.&lt;/SPAN&gt;&lt;/BODY&gt;&lt;/HTML&gt;</description>
      <pubDate>Wed, 05 Mar 2008 16:14:32 GMT</pubDate>
      <guid>https://connect.hyland.com/t5/alfresco-archive/ocr-alfresco/m-p/42821#M23181</guid>
      <dc:creator>rguinot</dc:creator>
      <dc:date>2008-03-05T16:14:32Z</dc:date>
    </item>
    <item>
      <title>Re: OCR + Alfresco</title>
      <link>https://connect.hyland.com/t5/alfresco-archive/ocr-alfresco/m-p/42822#M23182</link>
      <description>&lt;HTML&gt;&lt;HEAD&gt;&lt;/HEAD&gt;&lt;BODY&gt;&lt;SPAN&gt;Bonjour,&lt;/SPAN&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;SPAN&gt;le modèle Alfresco est extensible.&lt;/SPAN&gt;&lt;BR /&gt;&lt;SPAN&gt;Cela signifie que vous pouvez garder dans un repository Alfresco votre document sous la forme d'une image et de texte résultat de l'OCR dans 2 propriétés de type "d:content".&lt;/SPAN&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;SPAN&gt;Pour ma part, je stockerai le résultat de l'OCR dans la propriété appelée "cm:content" pour qu'elle soit indexée en full texte.&lt;/SPAN&gt;&lt;BR /&gt;&lt;SPAN&gt;Ensuite j'ajouterai une autre propriété avec un aspect. La propriété également de type cm:content dans laquelle je stockerai l'image.&lt;/SPAN&gt;&lt;BR /&gt;&lt;BR /&gt;&lt;SPAN&gt;De totes façon, il vous faudra également concevoir interface pour cela et je vous conseille de contacter un partenaire Alfresco pour cela.&lt;/SPAN&gt;&lt;/BODY&gt;&lt;/HTML&gt;</description>
      <pubDate>Thu, 06 Mar 2008 07:59:41 GMT</pubDate>
      <guid>https://connect.hyland.com/t5/alfresco-archive/ocr-alfresco/m-p/42822#M23182</guid>
      <dc:creator>pdubois</dc:creator>
      <dc:date>2008-03-06T07:59:41Z</dc:date>
    </item>
  </channel>
</rss>

