anydoc
anydoc convertit Word, PowerPoint, Excel, OpenDocument, RTF, EPUB, CSV et PDF en Markdown propre au format GitHub-Flavored. Construit en Rust avec des liaisons Node, Python et WebAssembly, il offre une sortie cohérente, consciente des ressources, avec une latence en millisecondes pour les agents, pipelines RAG et flux de travail développeurs.
Vue d’ensemble
Glissez vos fichiers bureautiques dans anydoc et recevez un Markdown structuré et propre au format GFM avec titres, listes, tableaux, notes de bas de page, liens et références aux ressources intactes. La bibliothèque détecte les formats à partir des octets, normalise la structure via un modèle partagé, et sérialise une seule fois pour une sortie prévisible et identique.
Un Markdown cohérent pour chaque format bureautique
Idéal pour les ingénieurs construisant des pipelines RAG et de recherche, des tâches d’ingestion de données et ETL, des agents devant lire des documents arbitraires, et des outils développeurs nécessitant un Markdown stable comme format d’échange. Les équipes remplaçant des scripts fragiles spécifiques à un format ou des piles bureautiques lourdes sans interface bénéficient d’une sortie unique et prévisible. Les services back-end traitent les documents hors thread ; les flux de données Python libèrent le GIL ; les applications navigateur convertissent localement avec WASM pour la confidentialité. Si vous avez besoin d’un Markdown propre, structuré et sans surprises, anydoc est conçu pour cela.
- Analyse plusieurs formats bureautiques en un modèle de document partagé et cohérent.
- Sérialise une seule fois en Markdown GitHub-Flavored avec un comportement identique pour toutes les entrées.
- Détecte le format à partir des octets du fichier pour gérer les documents mal étiquetés ou sans extension.
- Expose des liaisons Node, Python et WebAssembly pour un déploiement flexible.
- Conserve les ressources intégrées et les métadonnées avec le Markdown rendu.

Pourquoi les équipes choisissent anydoc
Notes techniques et garanties
Utilisez la CLI avec npx @firecrawl/anydoc pour convertir des fichiers ou passer par stdin. Pour Node.js, installez le package et appelez toMarkdown ou toDocument ; Python utilise pip install firecrawl-anydoc avec to_markdown ou to_document. La version WebAssembly s’exécute entièrement dans le navigateur après initialisation. anydoc est aussi disponible comme compétence Agent ; ajoutez-la avec npx skills add firecrawl/anydoc pour que les agents convertissent automatiquement les documents rencontrés. La détection de format se fait à partir des octets, tandis que CSV accepte un format explicite en l’absence de signature. Les variantes d’erreur distinguent les entrées non supportées, chiffrées, malformées ou limitées en ressources pour une gestion robuste dans les pipelines.
Un seul sérialiseur, une seule sortie : un Markdown propre au format GFM, prévisible, quel que soit le document d’entrée.
Premiers pas et intégration
anydoc remplace les scripts de liaison et les piles bureautiques lourdes par un convertisseur compact, local et multi-format. Le modèle partagé et le sérialiseur Markdown unique garantissent la cohérence ; les liaisons Node, Python et WASM s’adaptent aux environnements des équipes. Un comportement rapide et déterministe, la gestion des ressources et des variantes d’erreur explicites facilitent l’exploitation à grande échelle sans surprises.
Ouvrez l’outil et examinez son expérience produit principale.
Créez votre compte ou accédez à votre espace de travail existant.
Utilisez votre propre tâche pour évaluer la vitesse, la qualité et l’adéquation.
Vérifiez des outils IA similaires avant de prendre une décision finale.



Commentaires (0)
Aucun commentaire trouvé