Showing posts with label html. Show all posts
Showing posts with label html. Show all posts

Thursday, June 25, 2026

données structurées JSONL dans du HTML pour être moissonner proprement par AI

 

Les données structurées ont des balises généralement au format JSON-LD ajoutées au code HTML d’une page web pour aider les moteurs de recherche et agents AI à comprendre et interpréter le contenu de manière explicite. Elles s’appuient sur un vocabulaire standardisé, principalement Schema.org, et permettent à Google (ou Bing) d’afficher des résultats enrichis (rich snippets) dans les pages de résultats : étoiles d’avis, prix de produits, FAQ, infos recettes, événements, etc.

La réalité des données structurées et des LLM

Il est important de préciser que les données structurées ne sont pas un Pass pour entrer dans les LLM (modèles de langage). À ce stade, rien ne prouve qu’un modèle conversationnel « lit » directement ce code JSON-LD comme un signal décisif de compréhension. De plus, ajouter quelques blocs de balisage de données structurées ne suffira pas à améliorer mécaniquement la visibilité dans ces nouvelles interfaces génératives. La vraie question à poser est : comment une marque réduit-elle l’ambiguïté dans les systèmes qui filtrent, relient, interprètent et fiabilisent l’information avant qu’une réponse soit générée ?

Un LLM ne « lit » pas votre site comme un consultant qui inspecterait une page avec un crawler. Le mécanisme est différent. Du côté de Google et Gemini, l’impact est direct et documenté. Google lit les données structurées, les exploite pour construire les Rich Snippets, alimenter les Knowledge Panels, enrichir Google Shopping, identifier les entités et rattacher les auteurs. Gemini s’appuie sur cette même infrastructure.

En revanche, pour des concurrents comme ChatGPT et Perplexity, l’impact est indirect. Ces modèles font souvent abstraction du JSON-LD présent dans le code source. Ils ingèrent principalement du texte brut ou du markdown, et privilégient le texte brut en purgeant le corpus de tout « bruit » technique.

Vous ne structurez donc pas pour ChatGPT, mais pour Google, et ChatGPT en bénéficie en aval. L’impact des données structurées sur la visibilité générative n’est pas uniforme : il est direct et mesurable chez Google, indirect mais réel chez les LLM tiers. Réduire ce sujet à « les LLM lisent-ils le JSON-LD ? » revient à poser la mauvaise question.

Le marché se trompe souvent en considérant les données structurées comme des éléments de conformité technique. On ajoute du JSON-LD, on valide dans un outil, et si tout est vert, on considère le sujet plié. Ce principe est dépassé.

Google et Bing ne raisonnent plus seulement en clusters de contenus, mais en entités, en relations, en graphes de connaissances. Ce qui compte n’est plus uniquement votre capacité à approfondir un sujet, mais aussi votre capacité à exister clairement dans un réseau de compréhension plus vaste.

La lisibilité par les machines

Un encodage utile ne sert pas seulement à rendre une page « parseable ». Il sert à déclarer des relations dans ce réseau. On ne se contente plus de structurer des données, on construit la représentation de votre marque dans les systèmes qui décident si elle est une information ou une réalité établie. Le sujet n’est plus d’être conforme, mais d’être intelligible.

Référence

Friday, October 6, 2023

best HTLM-viewer en ligne (≠de HTML-editeur)

 HTLM-viewer en ligne c'est juste pour écrire du HTML directement avec des clik pour insérer des tag et voir en temps réel l'interprétation du code.

https://htmlcodeeditor.com/ simple et efficace; j'aime bien les 2 fenêtres:




https://codebeautify.org/htmlviewer

https://jsonformatter.org/html-viewer

https://www.w3schools.com/html/tryit.asp?filename=tryhtml_editors


HTML-editeur c'est pour utiliser un traitement de texte qui va générer du HTML

encore nommés "Rich Text Editor"

les célèbres:

mais aussi ce présent HTML-editeur de blogger où je tape ces mots ;)

et aussi 

et en JSON

Editor.js is a block-style editor for rich media stories. It outputs clean data in JSON instead of heavy HTML markup. And more important thing is that Editor.js is designed to be API extendable and pluggable.

So there are a few key features:
  • Clean data output
  • API pluggable
  • Open source

Wednesday, August 2, 2017

pdf and HTML5, with or without javascript? How to customize the look and feel of the PDF toolbar? interactive links


Embedding PDFs without JavaScript

be careful:
As of iOS 9, none of these examples (without JavaScript) work properly in Safari for iOS.

example with iframe

<iframe src="/pdf/sample-3pp.pdf#page=2" height="100%" width="100%">
This browser does not support PDFs. Please download the PDF to view it: <a href="/pdf/sample-3pp.pdf">Download PDF</a>
</iframe>

embed, object, iframe

https://pdfobject.com/static.html


PDF.js is a Portable Document Format (PDF) viewer that is built with HTML5. PDF.js is community-driven and supported by Mozilla Labs. Our goal is to create a general-purpose, web standards-based platform for parsing and rendering PDFs.

This extension provides PDF.js as the default PDF viewer in Chrome.
https://chrome.google.com/webstore/detail/pdf-viewer/oemmndcbldboiebfnladdacbdfmadadm?hl=en

Embedding PDFs with JavaScript

example of PDFObject 2.0 library and Mozilla's PDF.js

PDFObject is not a rendering engine. PDFObject just writes an <embed> element to the page, and relies on the browser or browser plugins to render the PDF. If the browser does not support embedded PDFs, PDFObject is not capable of forcing the browser to render the PDF.

If you need to force browsers to display a PDF, we suggest using Mozilla's PDF.js. Note that PDF.js is subject to its own limitations, such as cross-domain security restrictions. PDFObject and PDF.js play well together, there are links to some great PDF.js examples in the Examples section below.

PDFObject does not provide the ability to customize the look and feel of the PDF toolbar. The toolbar is controlled by the browser, and will vary widely from browser to browser (Chrome versus Safari versus Firefox, etc.). Some of these browsers provide the ability to show or hide the toolbar, or a feature such as the search field, via PDF Open Parameters. However, in general the browsers do NOT provide any mechanism for customizing the toolbar. If you really need to customize the toolbar, try forking Mozilla's PDF.js and customizing it to suit your needs.


PDFObject does not validate the existence of the PDF, or that the PDF is actually rendered. The assumption is that you are specifying a valid URL and the network is functioning normally. PDFObject does not check for 404 errors, and JavaScript cannot detect whether the PDF actually renders, unless you are using PDF.js, which is outside the scope of PDFObject.

PDFObject does not magically implement PDF Open Parameters. As mentioned above, these parameters are not widely supported. The PDF rendering engine either supports them or doesn't — PDFObject cannot force the rendering engine to implement these features.
https://pdfobject.com/

jQuery Document Viewer

7$
https://codecanyon.net/item/jquery-document-viewer/1732515?ref=jqueryrain&ref=jqueryrain&clickthrough_id=156843077&redirect_back=true

Display a document in a DOM element on the page
Display document in a modal window

This plugin uses pdf.js to render pdfs.

generater and parallax

http://www.jqueryrain.com/?JRJVsd1V

Android

https://play.google.com/store/apps/details?id=com.google.android.apps.pdfviewer&hl=en
http://www.apkmirror.com/apk/google-inc/google-pdf-viewer/

PDF Viewing is now available directly in Google Drive. For environments where this cannot be deployed, Google PDF Viewer offers the same capabilities in a standalone app. View, print, search and copy text from pdf documents while you're on the go.

best of viewer for CMS wordpress

embedded pdf viewer and interactive links

problems

Wednesday, July 26, 2017

liseuses et évolution des marchés en 2017; workflow d'amazon pour la publication électronique/papier

Introduction

L'histoire de cette version "4" (6 pouces et WiFi; sept 2012) de Kindle qui était en promo à 59 euros au lieu de 79 euros, avec une livraison gratuite. L'écran tactile viendra après.
https://www.amazon.fr/gp/product/B007HCCOD0/
Écran Écran 6 pouces (diagonale visible de 15 cm), affichage encre électronique E Ink Pearl, technologie optimisée d'affichage de polices, 167 dpi, 16 niveaux de gris.
Dimensions 166 mm x 114 mm x 8,7 mm
Poids 170 grammes
Configuration Aucune, l'appareil est sans fil. Il n'y a pas besoin d'ordinateur pour télécharger du contenu.
Stockage sur l'appareil Jusqu'à 1 400 ebooks ou 2 Go (environ 1,25 Go disponible pour les contenus de l'utilisateur, y compris des fichiers word qu'il faut passer via sa messagerie amazon).
Stockage dans le Cloud Stockage gratuit dans le Cloud pour tout le contenu Amazon.
 
Autonomie de la batterie Une seule charge de batterie dure jusqu'à un mois avec la connexion sans fil désactivée, à raison d'une demi-heure de lecture par jour. Avec la connexion sans fil activée en permanence, la batterie dure jusqu'à 3 semaines. L'autonomie de la batterie variera en fonction de l'utilisation de la connexion sans fil, comme l'achat dans la boutique Kindle, les recherches sur internet, et le téléchargement de contenus.
Temps de charge Charge complète en 3 heures environ en connectant à un ordinateur le câble USB 2.0 (inclus dans la boîte du Kindle). Le chargeur secteur pour la France est vendu séparément.
 
Connexion Wi-Fi L'appareil se connecte aux réseaux Wi-Fi publics et privés ainsi qu'aux points d'accès qui utilisent les standards 802.11b, 802.11g, ou 802.11n ; avec sécurité WEP, WPA et WPA2 qui nécessitent un mot de passe. Il ne se connecte pas aux réseaux sécurisés WPA et WPA2 utilisant les méthodes d'identification 802.1X.  
Formats de contenus pris en charge Kindle Format 8 (AZW3), Kindle (AZW), TXT, PDF, MOBI non protégé, PRC natif ; HTML, DOC, DOCX, JPEG, GIF, PNG, BMP converti.

Les liseuses

Les liseuses ont peu évolué depuis leur apparition il y a dix ans et les fabricants peinent à convaincre les lecteurs de se rééquiper.
Près de dix ans après l'arrivée des premiers modèles de liseuses électroniques, l'enthousiasme n'est pas franchement de mise pour les quelques constructeurs qui se partagent le marché. En France, les ventes ne progressent plus vraiment, et depuis longtemps. Quelque 400.000 exemplaires sont écoulés bon an mal an.
Aucun acteur ne communique ses chiffres de vente, mais Amazon et Kobo se partagent l'essentiel du marché. « Nous sommes au coude-à-coude, avec une part de marché autour de 45 % chacun ", assure Fabian Gumucio, directeur marketing Europe du Sud de Kobo. Derrière suit le français Bookeen dont les produits sont distribués, parfois en marque blanche, chez Carrefour, Leclerc ou Relay.
Signe que le marché n'est pas à la fête, le japonais Sony, tout premier à avoir commercialisé une liseuse, dès 2004, s'est retiré de la compétition en 2014. Et, en octobre 2015, la plus grande chaîne de librairies britannique, Waterstones, a retiré les Kindle des rayons de ses 280 magasins, à peine trois ans après les avoir introduits, décrivant les ventes comme « désolantes ".

Pas vraiment de rupture

En réalité, « les liseuses sont surtout achetées par les très gros lecteurs. C'est un marché de niche ", explique Michaël Dahan, le PDG fondateur de Bookeen. Et ce marché est relativement saturé. Reste le renouvellement du parc, mais - malheureusement pour les constructeurs - les appareils vieillissent plutôt bien. En moyenne, les utilisateurs ne changent de liseuse que tous les trois à cinq ans. « C'est un produit simple, avec un côté affectif qui n'est pas négligeable, explique Michaël Dahan. Et il n'y a pas vraiment eu de rupture technologique. "
La principale innovation remonte à 2012 avec l'arrivée de l'éclairage intégré sur le Kobo Glo, qui permet de lire dans l'obscurité. C'est d'ailleurs ce qui sépare aujourd'hui l'entrée de gamme, entre 70 et 90 euros, des produits plus évolués, entre 130 et 200 euros. Depuis, Kobo a introduit un modèle pour lire dans son bain. Bookeen, de son côté, commercialisera bientôt un appareil muni d'un étui pour recharger la batterie à l'énergie solaire. Autant de petits plus pour le lecteur. Mais le coeur du produit n'a pas vu d'amélioration significative ces dernières années et n'en verra sans doute pas de sitôt.
L'arrivée de la couleur, notamment, qui permettrait de lire magazines et bandes dessinées numériques, ne figure pas à l'agenda des constructeurs, car incompatible avec la technologie actuelle de l'encre électronique utilisée dans les liseuses. Et, côté prix, Amazon a toujours été très clair : la société ne gagne pas d'argent sur les liseuses. Difficile dans ces conditions pour la concurrence de se différencier par les prix. « Tout le monde a été obligé de suivre », reconnaît Fabian Gumucio. Et de porter le fer sur les contenus, le seul véritable nerf de la guerre.

Ref


https://www.lesechos.fr/14/04/2016/LesEchos/22171-085-ECH_sur-un-marche-francais-des-liseuses-en-berne--les-marges-restent-inexistantes-faute-d-innovation.htm

Nouveautés en juin  2017

Deux distributeurs s'apprêtent à sortir des liseuses " newlook " au mois de mai. Le choix de la date n'a rien du hasard : elles sont destinées à équiper les vacanciers qui souhaitent lire sur les plages. Kobo présente le 2 mai un nouveau modèle étanche sans lumière bleue qui ne devrait donc pas perturber le fonctionnement de la mélatonine pendant la nuit. Elle sera vendue par la Fnac Darty, Boulanger, CD-Discount... De son côté, Carrefour prévoit de lancer une liseuse en marque blanche avec une offre de contenus. Elle sera fabriquée par Bookeen. Mais l'arrivée de ces nouveaux modèles ne peut pas faire oublier la réalité économique. La liseuse a du mal à décoller. Après un pic dans les années 2012 -2013, les ventes sont retombées. En France, les constructeurs rechignent à donner des chiffres mais les ventes sont en dessous de 500.000 par an. " La liseuse n'est qu'un élément de la chaîne du livre numérique, explique Michael Dahan, président de Bookeen, elle permet de vendre des e-books. On ne peut pas se contenter de mesurer le nombre de liseuses vendues. Ce sont de gros lecteurs qui achètent les liseuses et ils les gardent longtemps. "

Les deux groupes ont donc misé sur des appareils adaptés à des situations de lecture particulière. Kobo affirme que son nouveau modèle, la liseuse Aura H20, est étanche jusqu’à 60 minutes dans 2 mètres d’eau. On peut donc lire dans son bain ou sur la plage sans trop craindre les éclaboussures ou, pire, de la faire tomber dans l’eau. Elle peut contenir 6.000 livres numériques et l’autonomie de la batterie, selon le constructeur, atteint plusieurs semaines. Carrefour n’a pas souhaité donner d’indication sur le modèle qu’il prépare. Mais il est possible que Carrefour commercialise une liseuse équipée d’une feuille photovoltaïque. Cette dernière permettra de recharger la liseuse à l’énergie solaire, sans batterie ni câble.

Un marché concentré

Le marché de la liseuse s’est concentré. Deux acteurs mondiaux dominent le marché : Amazon avec les diverses déclinaisons du Kindle et Rakuten avec Kobo.
Les deux groupes sont des sites de commerce en ligne pour qui la liseuse est un produit d’appel. 
Le groupe japonais Rakuten est connu en France pour avoir racheté Price Minister en 2010 et Kobo en 2011. Il revendique 17 millions d’utilisateurs dans l’hexagone.
Deux autres acteurs de taille plus modeste, Bookeen et TEA, font concurrence aux deux mastodontes. Bookeen commercialise des liseuses sous son nom mais fabrique aussi des liseuses que la grande distribution vend en marque blanche. C’est ainsi que Carrefour commercialise des liseuses sous la marque « Nolim by Carrefour », fabriquée par Bookeen. TEA (The Ebook Alternative), lancé par le libraire Guillaume Decitre, est distribué dans les librairies et sur le site du groupe mais aussi par les acteurs de la grande distribution. Mais tous les constructeurs reconnaissent que le taux de renouvellement des liseuses est faible. Il n’y a pas la même course à l’innovation que sur les téléphones mobiles, si bien que les consommateurs les gardent plusieurs années avant de les changer.

Ref

https://www.challenges.fr/high-tech/la-liseuse-n-a-pas-dit-son-dernier-mot_470701

Kindle Direct Publishing KDP

Publiez, sans frais, des ebooks et livres brochés en autoédition via Kindle Direct Publishing et touchez des millions de lecteurs sur Amazon.
Tout de suite sur le marché. La publication prend moins de 5 minutes et votre livre apparaît dans les boutiques Kindle du monde entier dans les 24 à 48 heures.
Gagnez plus. Vendez vos livres en France, en Allemagne, en Italie, en Espagne, au Royaume-Uni, au Canada, aux États-Unis, en Inde, au Japon, au Brésil, au Mexique, en Australie et dans bien d'autres pays… Et percevez des redevances qui peuvent atteindre 70 %. Inscrivez-vous au programme KDP Select et gagnez plus grâce à Kindle Unlimited / Abonnement Kindle et à la Bibliothèque de prêt Kindle.
Gardez le contrôle. Gardez le contrôle de vos droits et définissez vous-même vos prix. Vous pouvez modifier vos livres à tout moment.
Publiez au format numérique et papier. Publiez des ebooks Kindle et des livres brochés gratuitement via KDP.

Mettez en forme votre manuscrit.
https://kdp.amazon.com/fr_FR/help/topic/A17W8UM0MMSQX6
Si vous avez besoin d’aide pour la mise en forme, consultez nos outils et ressources.
https://kdp.amazon.com/fr_FR/help/topic/A3IWA2TQYMZ5J6

Word est un excellent outil car il permet de réaliser très facilement la mise en forme. Nous vous conseillons donc d’écrire votre livre dans Word ou de convertir un fichier source existant au format Word (DOC ou DOCX) avant de continuer. Voici quelques conseils pour améliorer la présentation de votre ebook :

Format de fichier : enregistrez votre contenu au format DOC ou DOCX et sauvegardez régulièrement votre travail afin de vous assurer que toutes vos modifications seront conservées.

Tableaux : si vous devez intégrer des tableaux à votre livre, utilisez la fonctionnalité « Insérer un tableau » de Word.

Mise en page : vous pouvez utiliser les retraits par défaut de Word, des caractères gras ou italiques ainsi que des titres. En revanche, les polices spéciales, les en-têtes et les pieds de page ne sont pas convertis au format Kindle. Veillez donc à les éviter.

Pour offrir une navigation facile au sein de votre livre, nous vous conseillons de créer une table des matières active. En effet, le contenu Kindle peut être redimensionné, si bien que les numéros de page ne sont pas vraiment exploitables.

  • Sur PC, vous pouvez utiliser l’outil intégré dans Word pour créer la table des matières (en savoir plus: https://kdp.amazon.com/fr_FR/help/topic/A1JMIOQ2RP4DPK).
  • Sur un Mac, vous devez créer une table des matières manuellement à l’aide des fonctions Lien hypertexte et Signet.


Dès lors que vous avez inséré tous les sauts de page et que vous êtes satisfait de la disposition de votre livre, enregistrez le fichier Word dans le dossier Documents ou sur le Bureau au format Page Web, filtrée (*HTM et *HTML) (PC) ou Page Web (.htm) (Mac). Ce format est obligatoire pour créer un ebook correct.

Quand vous enregistrez le fichier Word au format HTML, toutes les images présentes dans le document (s’il y en a) sont extraites et stockées dans un dossier distinct. Ce dossier apparaît au même emplacement que le fichier HTML.

Une fois que vous êtes satisfait de la qualité et de la présentation de votre livre, chargez le fichier dans votre Bibliothèque KDP, puis effectuez la procédure de publication.

À partir du moment où vous avez cliqué sur « Enregistrer et publier », il faut compter environ 24 heures pour que le livre soit mis en vente dans la boutique Kindle. Les autres caractéristiques du livre, comme la description et les liens vers les éditions papier associées, sont présentées sur la page produit sous 48 à 72 heures.

Kindle Textbook Creator 

version 1.13.7.0 du 7 sept 2016, testé sur mac Sierra.
Il est multilingue:



Kindle Textbook Creator est un outil téléchargeable qui vous permet de convertir des PDF de livres comprenant du contenu multimédia enrichi en vue de leur publication sur les appareils et applications Kindle. Avec Kindle Textbook Creator, vous pouvez plus facilement travailler sur vos manuels, livres de cuisine, carnets de voyages et autres livres contenant de nombreux éléments multimédias tels que :
  • Tableaux
  • Graphiques
  • Équations
  • Pistes audio
  • Vidéos
  • Pop-ups d’images
  • Fichiers audio intégrés
  • Boutons de lecture audio invisibles placés en superposition

Vous pouvez utiliser n’importe quel fichier PDF pour ajouter des pages à votre livre.
Kindle Textbook Creator accepte les fichiers d’origine d’une ou plusieurs pages au format .pdf.

Avant d’importer votre PDF, vérifiez qu’il comporte des signets pour chaque entrée de la table des matières. Lorsque vous avez chargé votre livre finalisé sur KDP, Amazon convertit ces signets pour créer la table des matières électronique qui permettra aux lecteurs de naviguer au sein de votre livre.

Vous pouvez ajouter des sons, vidéos et images en pop-up à votre manuel sous la forme d’icônes ou de liens hypertextes.
Voici les types de fichier pris en charge par Kindle Textbook Creator :
Vidéo : .mp4
Audio : .mp3
Image : .jpg, .jpeg ou .png

Format d’exportation
Kindle Textbook Creator exporte le livre terminé en .kpf (Kindle Package Format) afin que vous puissiez le charger sur Kindle Direct Publishing (KDP) et le proposer ainsi aux clients.
les livres créés avec Kindle Textbook Creator peuvent uniquement être chargés sur KDP ; à l’heure actuelle, ils ne sont pas compatibles avec Amazon Vendor Central.

Une fois votre livre publié, les lecteurs ont automatiquement accès aux fonctionnalités de lecture Kindle : surlignage, bloc-notes, fiches récapitulatives, dictionnaire...

Ref

https://kdp.amazon.com/fr_FR/

Digital Publishing 2.0; publication numérique 2.0 (post bilingue)


English

The first generation of digital publishing delivered the electronic equivalent of a book. But not all books. It was for books with layouts and content that were simple enough for the small black–and–white screens of e–readers. This means that digital publishing opportunities were pretty much limited to trade books and newspapers. Magazines and about 85% of books have not been able to reach these devices, nor have corporations or other organisations been able to tap into them, because they just aren't suitable for design–rich content and their displays are too limited. The introduction of iPad brought about a revolutionary change.

Digital Publishing 2.0 is marked by the introduction of an entirely new digital experience — one that promises an unprecedented level of consumer interaction with content through smartphones, e–readers, and tablets, as well as an equally engaging experience through computers.

Digital Publishing 2.0 technology delivers a full-color, interactive multimedia experience through larger, more sophisticated displays in which consumers explore content (whether books, magazines, newspapers, product catalogs, advertisements, or other material) through clickable videos, sound files, and other interactive functionality.

The most important difference between Digital Publishing 2.0 and Digital Publishing 1.0 is that it offers publishers and others a variety of ways to distinguish digital content from traditional content. This means publishers can — at least potentially— develop new revenue models for digital experiences.

ref

http://www.quark.com/en/Solutions/Content-Automation/Digital-Publishing.aspx

Français

Le Digital Publishing (publication numérique) de première génération permettait de produire l'équivalent d'un livre au format électronique. Mais pas de tous les livres. Seuls étaient concernés les livres à la mise en page et au contenu suffisamment simples pour être adaptés aux petits écrans en noir et blanc des lecteurs numériques. Les possibilités de publication numérique étaient donc généralement limitées aux ouvrages professionnels et aux journaux. Les grandes entreprises et autres organisations n'ont pas pu les utiliser car ils n'étaient pas compatibles avec les contenus dotés d'un graphisme riche et à cause de leurs écrans trop limités. Le lancement de l'iPad et iPhone (puis tablette android) a été à l'origine d'un changement révolutionnaire.

Le Digital Publishing 2.0 est marquée par la naissance d'une toute nouvelle expérience numérique qui promet aux clients un niveau d'interaction sans précédent avec les contenus via les smartphones, lecteurs numériques et tablettes, ainsi qu'une expérience tout aussi passionnante sur ordinateur.

La technologie mise en œuvre dans la Publication numérique 2.0 offre une expérience multimédia interactive toute en couleurs sur des écrans plus grands et plus évolués avec lesquels les clients peuvent explorer des contenus (livres, magazines, journaux, catalogues de produits, publicités ou autres) comme des vidéos, des fichiers audio, tout cela en un seul click.

La Publication numérique 2.0 se distingue avant tout de la Publication numérique 1.0 car elle offre différents moyens de démarquer les contenus numériques des contenus traditionnels. Les éditeurs et autres intervenants ont donc la possibilité de développer de nouveaux modèles de revenus pour les expériences numériques.

Les défis du multi-canal

Les défis liés à la mise en place de stratégies rentables pour le Digital Publishing 2.0

Malgré la popularité et la croissance rapide des terminaux mobiles, des défis de taille sont à relever dans la course au succès du Digital Publishing 2.0.

Tout d'abord, les éditeurs doivent créer des contenus dotés de fonctionnalités avancées, ce qui peut exiger une programmation complexe et beaucoup de travail technique. Ils doivent créer ces contenus enrichis pour différentes plates-formes, pour des terminaux qui arrivent sans cesse plus nombreux sur le marché et pour les différents types de supports. Afin de mener ces tâches à bien en limitant les coûts, vous avez besoin d’outils permettant aux concepteurs (et non aux développeurs) de créer du contenu enrichi qui fonctionnera correctement sur la totalité des plates-formes, des terminaux numériques et des supports.
Ensuite, le contenu enrichi doit fonctionner dans une application qui fournit non seulement toutes les fonctionnalités multimédia interactives attendues par le client, mais aussi d'autres qui le surprendront.
Pour finir, des canaux de distribution sont requis qui faciliteront pour un client la recherche, l'achat et le téléchargement de votre contenu.

Solution-> Créez des contenus interactifs enrichis indépendants de la plate-forme, du média et du périphérique numérique

Les logiciels (comme Quark ou Indesign ou Scribus ou autres PAO) peuvent vous aider à incorporer la publication numérique dans votre stratégie de publication multicanal pour cibler les tous derniers terminaux mobiles, y compris les tablettes comme l'iPad™ ou Iphone d'Apple® et les Galaxy Tab® ou smartphone de Samsung comme les ordi portables Gnu/linux, mac OSX, windows. De plus, avec la stratégie de contenus indépendants du média de Quark, nos logiciels vous protègent contre les errances permanentes de la technologie liées à l'apparition de nouveaux appareils sur le marché.

L'approche de Quark en matière de publication numérique repose sur deux fondements clés :
  1. Indépendance vis-à-vis des plates-formes : vous ne pouvez pas vous permettre de créer du contenu et de développer des applications pour chaque plate-forme, support et appareil. C’est pour cette raison que, au lieu de limiter vos données à un format spécifique, Quark vous permet de créer des contenus indépendants des plates-formes et des supports. Vous pouvez ainsi publier automatiquement dans tous les formats qui vous conviennent.
  2. Aucune programmation requise : nos logiciels permettent aux concepteurs graphiques de se lancer dans des expériences interactives fascinantes sans avoir à faire appel aux développeurs.

Publication numérique : une capacité de base d'une solution de publication dynamique

Nos capacités de publication numérique font partie intégrante de notre solution de publication dynamique, qui permet à de grandes entreprises d'améliorer leur productivité et de réaliser des économies sur les coûts dans tous leurs environnements de publication d'entreprise. L'utilisation de notre solution de publication dynamique permet à chacun de créer un contenu XML structuré dans Microsoft Word, d'automatiser l'assemblage de contenus personnalisés et de conception élaborée destinés à plusieurs publics, et de publier automatiquement sur papier, Web et terminaux numériques.

CRÉATION DE CONTENUS XML

Création XML, création structurée, création de contenu intelligent. Ces trois processus désignent le même concept : une méthode de création de contenu différente de celles proposées par les applications de traitement de texte et PAO qui génèrent, quant à elles, du contenu non structuré. De plus en plus d'entreprises se tournent vers la création de contenus XML car il s'agit de la première étape pour améliorer le processus de publication et obtenir ainsi plus de qualité et de flexibilité tout en réduisant les coûts.

Pourquoi choisir la création de contenus XML ?

Parce que la création de contenus non structurés — la base des logiciels de traitement de texte et de PAO — n'est plus en mesure de répondre aux exigences de publication des entreprises qui doivent fournir toujours plus d'informations de meilleure qualité, et à un tarif inférieur, pour davantage de types de supports.

Mais avec les logiciels de publication classiques, les rédacteurs ne se contentent pas de créer les informations : ils doivent également les mettre en forme et contrôler chaque élément de la mise en page, un processus extrêmement laborieux qu'il faudra répéter pour chaque type de support : 
  • papier, 
  • Web 
  • numérique. 
En outre, pour réutiliser les informations, il faut procéder par copier-coller, d'où la création de copies redondantes qui doivent être relues, traduites et mises à jour séparément, et ce aussi longtemps que les informations vivent. Ces carences entraînent des problèmes de précision, d'accessibilité et de présentation des informations car le volume de travail est trop important et accroît les risques d'erreur.

Fonctions de création XML

Pour surmonter les inefficacités liées au contenu non structuré, la création de contenus XML offre 5 avantages clés.

1/Dissociation du contenu et de sa mise en forme : 

au lieu d'appliquer une mise en forme pour différencier les divers éléments d'un document (par exemple, faire en sorte qu'un titre soit plus grand qu'un sous-titre), le rédacteur définit la fonction de chaque élément. Par exemple, il peut désigner le titre sous la forme <title>, et non pas 24 pt. Arial Bold.

2/Publication automatisée : 

les documents XML ne contenant aucune information de mise en forme, un système de publication peut appliquer séparément une mise en forme via un processus automatisé. Par exemple, le système peut désigner un élément <title> sous la forme 24 pt. Arial Bold dans la version papier et sous la forme 12 pt. Verdana sur un téléphone mobile. Ainsi, les rédacteurs n'ont pas à se soucier de la mise en forme et de la conception, des tâches laborieuses pouvant monopoliser le tiers voire la moitié de leur temps de travail.

3/Publication multicanal : 

vous pouvez publier automatiquement vos informations pour différents types de supports : papier, Web et terminaux mobiles. Cette méthode évite à un autre groupe de devoir créer manuellement chaque type de support supplémentaire, un processus long, coûteux et risquant d'induire des erreurs.

4/Composants réutilisables : 

le format XML permet aux rédacteurs de fractionner leurs documents en plusieurs composants réutilisables. Au lieu de copier-coller le contenu, ils peuvent réutiliser un composant simplement en y faisant référence. En cas de modification du composant original, tous les documents qui l'utilisent peuvent être automatiquement mis à jour avec la dernière version des informations de ce composant. Cette méthode améliore la précision et la cohérence des données.

5/Personnalisation : 

le format XML permettant de fractionner les documents en plusieurs composants, vous pouvez assembler automatiquement ces composants afin d'obtenir des publications personnalisées en fonction des besoins de chaque public, ce qui augmente la satisfaction du client.
---

Création XML depuis Quark

Quark Author est un logiciel basé sur le Web conçu spécifiquement pour permettre aux utilisateurs métier de créer du contenu XML, mais dans un environnement de traitement de texte familier, laissant le XML dans les coulisses. Les rédacteurs peuvent créer et réutiliser des composants de contenu qui sont gérés avec Quark Publishing Platform.

Quark XML Author for Microsoft® Word permet à chaque utilisateur de créer du contenu XML structuré dans Microsoft Word. Conçu pour une prise en main facile et rapide, Quark XML Author établit les bases d'un système de publication automatisé capable de rationaliser votre processus de publication, d'augmenter la cohérence de vos informations et d'améliorer ainsi les résultats de votre entreprise.
Lancé en 2002, Quark XML Author™ for Microsoft Word est un outil de création XML de nouvelle génération. Il se présente sous la forme d'un module complémentaire pour Microsoft Word qui permet à tout utilisateur de créer facilement des documents XML, sans connaissance de ce langage ni formation.

XML : le meilleur moyen de créer des informations

Le XML est une norme complexe et le fait de devoir se servir d'outils logiciels spécialisés le rend encore plus compliqué à apprendre pour les rédacteurs.

Création de documents XML dans Microsoft Word

Quark XML Author for Microsoft Word permet à tout utilisateur de créer facilement des documents XML, sans connaissance de ce langage ni formation. Quark XML Author est un module d'extension pour Microsoft Word qui permet aux rédacteurs de créer des composants d'information utilisables directement dans Quark Publishing Platform, qui les combine automatiquement de manière appropriée pour produire des documents imprimés de grande qualité ou des versions numériques pour le Web ou d'autres supports électroniques.

Comme Quark XML Author fonctionne au sein même de Word, vous pouvez le déployer dans toute votre entreprise de manière à profiter des gains d'efficacité et des améliorations apportées à tous les documents issus des différents services grâce au format XML.

Quark_Publishing_Platform

Les modules de Quark Publishing Platform fonctionnent de manière complémentaire pour permettre l'assemblage automatisé et la publication multicanal de contenu pour différents publics et types de médias.

La plate-forme constitue une solution de publication personnalisable complète facilitant la création de communications ciblées et pertinentes qui améliorent la relation avec le client et renforcent son niveau de satisfaction. Outre le papier et le Web, Quark Publishing Platform prend également en charge la réutilisation et la réorientation du contenu et de la mise en page pour la diffusion de communications numériques interactives riches et attrayantes pour les terminaux mobiles et les tablettes.
voir photo au début de ce post.

Pour en savoir plus, merci de sélectionner un des modules de Quark Publishing Platform sur:
http://www.quark.com/fr/Products/Quark_Publishing_Platform/How_It_Works.aspx
l est rigolo de voir que quark a utilisé adobe edge 5.0 (librairie js) qui n'est plus développé depuis fin 2015...

ref

http://www.quark.com/fr/Solutions/Content-Automation/Digital-Publishing.aspx

Thursday, July 20, 2017

HUB text/PAO une syntaxe pour différentes cibles input et output (backends, targets ou writers), de manière à obtenir du HTML du LaTeX, page de man: pandoc


hexadécimal

Au départ si on a que du texte sans mise en forme, on peut écrire en hexadécimal comme dans ma jeunesse des années 70 (en ASCII ou étendue pour les caractères français par exemple). Il suffisait de connaitre par coeur la table ASCII de 128 correspondances qui est une norme informatique de codage de caractères des années 60. Et tout cela avec un clavier de 0-9 et A-F soit 16 touches (même pas une touche carriage return  car c'est le code #D ni même une touche espace car c'est #20)!
http://ascii.cl/
Et pour l'histoire:
https://fr.wikipedia.org/wiki/American_Standard_Code_for_Information_Interchange

C'était clair, il y avait celui qui tapait ses idées au kilomètre puis celui qui mettait en forme.

que du text mis en forme (et un peu de "PAO") et comparaison des softs

Si on a que text (par exemple ASCII ou UTF-8) c'est assez simple.
Avec du balisage léger et des transcodeurs, on a du Hub-text.
voir une liste partielle des output formats:
https://en.wikipedia.org/wiki/Lightweight_markup_language

https://en.wikipedia.org/wiki/Comparison_of_document_markup_languages

https://en.wikipedia.org/wiki/Comparison_of_documentation_generators
(and  programming languages).
example: ROBODoc is a documentation tool similar to Javadoc and licensed under the GPL. It is used to extract API documentation from source code. It can be used with any language that supports comments and works by extracting specially formatted headers. These are then reformatted into HTML, DocBook, TROFF, ASCII, LaTeX, PDF, or RTF.
It can be used to document any programming artifact, such as: classes, functions, tests, makefile entries, etc.
ROBODoc works with C, C++, Fortran, Perl, shell scripts, Assembler, DCL, DB/C, Tcl/Tk, Forth, Lisp, COBOL, Occam, Basic, HTML, Clarion, and any other language that supports comments.
https://en.wikipedia.org/wiki/ROBODoc


Une analyse que je partage

Comparaison des langages de balisage (markup) léger (lightweight) : Txt2tags, Pandoc, Docutils, AsciiDoc, Deplate, Stx2any, AFT, Markdown et Textile:
http://fgallaire.flext.net/comparaison-langage-balisage-markup-lightweight-leger-txt2tags-pandoc-docutils-asciidoc-deplate-stx2any-aft-markdown-textile/

La bureautique est la principale utilisation de l’informatique depuis sa création. Pourtant, les outils majoritairement utilisés dans ce domaine, les logiciels de traitement de texte WYSIWYG comme LibreOffice ou MS word, laissent la majorité des informaticiens et des ergonomes totalement désespérés.
Ces logiciels ont en effet un nombre de défauts très important : ils font se concentrer sur la forme et non sur le fond, leur résultat final ne correspond souvent pas à ce qui est affiché, ils sont incompatibles entre eux, ce sont d’énormes usines à gaz, ils ne fonctionnent qu’en mode graphique, etc.

Il a donc fallu penser à une manière de donner ces instructions de mise en forme au sein du fichier texte lui-même, et c’est ainsi que sont apparus les langages de balisage (markup), dont les plus connus sont HTML (inventé en 1991 par Tim Berners-Lee) et LaTeX (créé en 1985, et basé sur TeX, inventé par le grand Donald Knuth en 1977), et dont la première grande figure fut Roff, un programme Unix historique développé à partir de 1961, et dont la version GNU, Groff, est installée par défaut sur toutes les distributions GNU/Linux, puisqu’on l’utilise encore pour les pages de man des logiciels.

Ces langages représentent une nette amélioration, mais ont tous un gros problème : ils sont gênants ! On ne retrouve plus aussi facilement son contenu au milieu de toutes ces balises supplémentaires, sans parler du fait que les syntaxes complexes ouvrent la voie à de nombreuses erreurs de compilation.

C’est en 1995 que l’on trouva la solution de ce problème, avec la création du premier langage Wiki, dont le but principal était de permettre l’édition facile de pages web par tout un chacun, et dont l’utilisateur actuel le plus célèbre est l’encyclopédie libre Wikipédia. S’il y a presque autant de syntaxes différentes que de logiciels Wiki, elles ont toutes la caractéristique d’utiliser des caractères textuels simples et intuitifs pour donner les indications de formatage du texte.
http://www.wikicreole.org/wiki/Reasoning

https://www.mediawiki.org/wiki/Help:Formatting
https://fr.wikipedia.org/wiki/Aide:Syntaxe_(wikicode)
https://fr.wikipedia.org/wiki/Aide:Ins%C3%A9rer_un_tableau_(wikicode,_avanc%C3%A9)
https://fr.wikipedia.org/wiki/Mod%C3%A8le:BUtilisateur
https://www.mediawiki.org/wiki/MediaWiki/fr

J'ai toujours aimé le principe du "folding editor".
le premier fut STET  'STructured Editing Tool' de 1977
https://en.wikipedia.org/wiki/STET_(text_editor)
A folding editor is a text editor which supports text folding or code folding, a mechanism allowing the user to hide and reveal blocks of text—usually named. Typically this is done to allow the user to better picture the overall structure of a document or program.
Folding is provided by many modern text editors, and syntax-based or semantics-based folding is now a component of many software development environments...
https://en.wikipedia.org/wiki/Folding_editor


Mais pourquoi limiter ces langages de balisage léger à la seule génération de HTML ? Pourquoi ne pas utiliser la même syntaxe pour différentes cibles (appelées backends, targets ou writers selon les logiciels), de manière à obtenir aussi bien une page web en HTML, qu’un document en LaTeX pour l’impression, ou qu’une page de man pour un logiciel ? Ce sont les logiciels qui poursuivent ce but qui m’intéressent, ils constituent pour moi l’avenir de la bureautique informatique, et j’ai été amené à les comparer pour en choisir un dans lequel m’investir comme développeur.

Trois d’entre eux, Docutils, Deplate et Pandoc, ont un design évolué, avec une machine à états finis pour laquelle on peut écrire de nouveaux readers et writers de manière parfaitement propre. Cependant, malgré leurs grandes qualités, Deplate est un projet trop confidentiel (ainsi il n’est incompréhensiblement pas présent parmi les pourtant si nombreux paquets Debian), et je ne me sentais pas à la hauteur pour m’investir dans un projet comme Pandoc, totalement écrit en Haskell, qui est un langage de programmation complexe que j’aimerais beaucoup utiliser.
Je détaillerai Pandoc ci-dessous.

Txt2tags

J’ai rajouté dans ce comparatif Markdown et Textile, puisqu’ils ont chacun une implémentation en Python, mais ne générant que du HTML, ils ne m’intéressaient pas vraiment. AsciiDoc et Txt2tags ont un peu la même architecture, avec un gros fichier principal faisant tout le travail, que l’on peut configurer, respectivement avec un fichier .conf et deux dictionnaires Python (un pour les Tags et l’autre pour les Rules), pour créer de nouvelles cibles. AsciiDoc et Txt2tags sont donc plus aisés à prendre en main et à modifier rapidement que Docutils, qui est une très belle et très bien architecturée machine à états objet, mais aussi plus difficile à appréhender.
De plus, comme je désapprouvais totalement la politique de licence domaine publique de Docutils, il ne me restait plus qu’à faire mon choix entre Txt2tags et AsciiDoc. C’est principalement l’orientation très DocBook (un format ne m’intéressant personnellement pas du tout) d’AsciiDoc, et d’autres détails, comme la localisation en de nombreuses langues de Txt2tags et sa plus grande simplicité, qui m’ont finalement fait choisir Txt2tags.

Ce choix est confirmé par une étude plus avancée des différentes syntaxes. Ainsi alors que la syntaxe reST de Docutils ne dispose que de :

*italique* et **gras**

Txt2tags est beaucoup plus riche :

//italique// **gras** __souligné__ et --barré--

Le codage visuel est bien meilleur, et le compréhension instantanée avec la syntaxe de Txt2tags, puisque les slashs donnent l’impression penchée de l’italique, les étoiles imitent la surcharge du gras, les underscores donnent l’impression de soulignement, et les moins apparaissent comme une barre. De plus, l’utilisation généralisée des caractères de balisage en doubles, permet de lever à peu de frais un maximum d’ambiguïtés syntaxiques.

insertion d'une image est beaucoup plus simple Txt2tags
[[picture.png] http://fgallaire.flext.net]

Leur implémentation en Python permet à Txt2tags, reST (par Docutils) et AsciiDoc d’être utilisables à la fois comme logiciels de bureautique multiplateforme (Linux, Mac OS X, Windows et *BSD) et pour le web côté serveur. Depuis 2012, une implémentation de txt2tags en PHP est disponible, développée par Petko Yotov (le mainteneur et principal développeur de PmWiki) et sponsorisée par Eric Forgeot. Grâce aux nombreux efforts de ce dernier, il existe maintenant plusieurs implémentations de la syntaxe Txt2tags en JavaScript, avec une démo parfaitement fonctionnelle des possibilités de rendu côté client en temps réel. Et Matthew Pickering a quant à lui écrit un reader Txt2tags pour Pandoc.
En face, Markdown est représenté par une armada d’implémentations dans tous les langages utilisés sur le web côté serveur, et aussi en JavaScript côté client pour des prévisualisations efficaces sans Ajax, mais seul Pandoc, qui n’est pas si facile à compiler sur toutes les plateformes, propose autre chose qu’un rendu en HTML.
Je vais bien sûr continuer à travailler sur le logiciel Txt2tags, mais une implémentation de la syntaxe Txt2tags dans un parser Docutils, pour toucher directement toute la communauté des développeurs Python qui documentent leurs projets, et pouvoir bénéficier ensuite du sublime Sphinx, est un projet qui me motive de plus en plus.
Enfin, je suis toujours un peu nostalgique devant ce screenshot, parce que c’est en le voyant, avec en haut à gauche le fichier avec les balises, et en bas à droite celui avec le résultat texte brut, que j’ai pris conscience que Txt2tags faisait bien ce que j’espérais, et que comme en plus il était en Python, ce serait probablement le logiciel auquel j’allais contribuer !

Pandoc

Pandoc is a command-line tool. There is no graphic user interface. 
Pandoc is a Haskell library for converting from one markup format to another, and a command-line tool that uses this library. It can read MarkdownCommonMarkPHP Markdown ExtraGitHub-Flavored MarkdownMultiMarkdown, and (subsets of) TextilereStructuredTextHTMLLaTeXMediaWiki markupTWiki markupHaddock markupOPMLEmacs Org modeDocBookMusetxt2tagsVimwikiEPUBODT, and Word docx; and it can write plain text, MarkdownCommonMarkPHP Markdown ExtraGitHub-Flavored MarkdownMultiMarkdownreStructuredTextXHTMLHTML5LaTeX (including beamer slide shows), ConTeXtRTFOPMLDocBookOpenDocumentODTWord docxGNU TexinfoMediaWiki markupDokuWiki markupZimWiki markupHaddock markupEPUB (v2 or v3), FictionBook2Textilegroff man, [groff ms], Emacs Org modeAsciiDocInDesign ICMLTEI SimpleMuse and SlidySlideousDZSlidesreveal.js or S5 HTML slide shows. It can also produce PDF output on systems where LaTeX, ConTeXt, pdfroff, or wkhtmltopdf is installed.
Pandoc's enhanced version of Markdown includes syntax for footnotestables, flexible ordered listsdefinition listsfenced code blockssuperscripts and subscriptsstrikeoutmetadata blocks, automatic tables of contents, embedded LaTeX mathcitations, and [Markdown inside HTML block elements][Extension: markdown_in_html_blocks]. (These enhancements, described further under Pandoc's Markdown, can be disabled using the markdown_strict input or output format.)
In contrast to most existing tools for converting Markdown to HTML, which use regex substitutions, pandoc has a modular design: it consists of a set of readers, which parse text in a given format and produce a native representation of the document, and a set of writers, which convert this native representation into a target format. Thus, adding an input or output format requires only adding a reader or writer.
Because pandoc's intermediate representation of a document is less expressive than many of the formats it converts between, one should not expect perfect conversions between every format and every other. Pandoc attempts to preserve the structural elements of a document, but not formatting details such as margin size. And some document elements, such as complex tables, may not fit into pandoc's simple document model. While conversions from pandoc's Markdown to all formats aspire to be perfect, conversions from formats more expressive than pandoc's Markdown can be expected to be lossy.
This document is for people who are unfamiliar with command line tools. Command-line experts can go straight to the User’s Guide or the pandoc man page:

Modules 

In contrast to most existing tools for converting Markdown to HTML, pandoc has a modular design: it consists of a set of readers, which parse text in a given format and produce a native representation of the document, and a set of writers, which convert this native representation into a target format. Thus, adding an input or output format requires only adding a reader or writer.

Ref.

Pandoc’s enhanced version of Markdown 

Pandoc’s enhanced version of Markdown includes syntax for footnotes, tables, flexible ordered lists, definition lists, fenced code blocks, superscripts and subscripts, strikeout, metadata blocks, automatic tables of contents, embedded LaTeX math, citations, and Markdown inside HTML block elements. (These enhancements, described further under Pandoc’s Markdown, can be disabled using the markdown_strict input or output format.)

Tricks

you have a long markdown file in GitHub and want to have a TOC, you can use 
pandoc -t markdown_github --toc -o example-with-toc.md example.md

Using Markdown Templates

Math in Pure Markdown