MCP bêta
Utilisez DocAI directement depuis votre agent de codage
DocAI MCP connecte les agents de codage à l'intelligence documentaire de DocAI via le Model Context Protocol. Testé avec Codex, Claude Code et Gemini CLI, et compatible avec d'autres clients MCP stdio.
npx -y @synairo/docai-mcp@next install
npx -y @synairo/docai-mcp@next doctor
Vous développez plutôt du code applicatif ? Utilisez l'API REST
Démarrage rapide
-
Étape 1
Installer
npx -y @synairo/docai-mcp@next install
L'installateur configure les hôtes MCP pris en charge en utilisant leur propre mécanisme de configuration habituel. Les entrées existantes pour d'autres serveurs ne sont jamais modifiées.
-
Étape 2
Vérifier
npx -y @synairo/docai-mcp@next doctor
doctor vérifie la configuration et la connectivité à l'API DocAI. Il n'affiche jamais votre clé API.
-
Étape 3
Interroger votre agent
Exemple de demande à un agent de codage :
Intègre l'extraction de documents DocAI dans ce projet. Utilise l'architecture et les conventions existantes du projet. Garde les identifiants DocAI côté serveur. Gère les erreurs d'API et de traitement. Utilise les résultats d'extraction structurés. Ajoute les tests appropriés. Valide l'intégration avec un document d'exemple anonymisé.
Rien de magique ici. L'agent lit les capacités de DocAI et le guide d'intégration via MCP, inspecte votre projet et écrit lui-même l'intégration. Vous relisez le diff comme d'habitude.
Ce que l'agent fait réellement
- Découvre DocAI MCP
- Lit les capacités
- Lit les instructions d'intégration
- Inspecte le projet
- Implémente l'intégration
- Effectue des tests avec des données assainies
MCP aide l'agent de codage à comprendre et à utiliser DocAI. Il ne déplace pas l'intelligence documentaire dans l'agent de codage.
Outils
docai_get_capabilities
Découvrez les formats pris en charge, les limites et le versionnage de l'API avant que l'agent n'écrive du code d'intégration.
docai_get_integration_guide
Récupère les instructions d'intégration tenues à jour que l'agent doit suivre pour ce projet.
docai_extract_file
Soumet un document situé dans l'espace de travail actuel et renvoie des résultats d'extraction compacts et structurés. Seuls les fichiers situés dans l'espace de travail sont accessibles.
docai_get_result
Récupère le résultat d'une tâche encore en cours de traitement lorsque docai_extract_file a répondu.
Architecture
Le package MCP n'implémente pas de pipeline de traitement de documents distinct. Il utilise la même API DocAI et le même noyau de traitement que les intégrations directes à l'API.
API pour les développeurs. MCP pour les agents de codage.
Utilisez MCP si
- vous travaillez depuis un agent de codage compatible MCP
- vous voulez que l'agent découvre les instructions d'intégration DocAI
- vous souhaitez une intégration de projet assistée par l'agent
- vous voulez tester des documents de l'espace de travail local via l'interface MCP
Utilisez l'API REST si
- vous développez une intégration de production directe
- vous appelez DocAI depuis du code applicatif
- vous implémentez votre propre client
- vous intégrez depuis une infrastructure sans MCP
Les deux approches utilisent le même backend DocAI.
Limites de sécurité
- Accès aux fichiers limité à l'espace de travail
- Le traitement des fichiers locaux est limité à l'espace de travail configuré. La traversée de chemins et les échappements par lien symbolique en dehors de l'espace de travail sont rejetés.
- Pas de shell générique
- DocAI MCP n'expose aucune exécution de commande shell arbitraire.
- Pas de navigateur de système de fichiers arbitraire
- Il n'existe pas d'interface générique d'exploration du système de fichiers, seulement l'outil d'extraction limité à l'espace de travail.
- Pas d'URL de document arbitraires
- L'interface MCP n'expose aucune ingestion générique de documents à partir d'URL arbitraires.
- Limite face à l'injection de prompt
- Le texte trouvé dans les documents est traité comme des données de document, et non comme des instructions destinées à l'agent de codage.
- Identifiants
- La clé API est fournie via des mécanismes de configuration et d'environnement. Elle ne doit jamais être intégrée dans des prompts ni versionnée dans le contrôle de code source.
- Sortie structurée
- Les résultats d'extraction structurés constituent l'interface par défaut.
- OCR brut
- L'OCR brut est désactivé par défaut.
Clients testés
| Client | Statut | Notes |
|---|---|---|
| Codex CLI 0.147.0 | Testé | MCP stdio |
| Claude Code 2.1.231 | Testé | MCP stdio |
| Gemini CLI 0.53.0 | Testé | MCP stdio |
| Autres clients MCP stdio | Compatible avec le protocole | Non certifié individuellement |
Les versions ci-dessus sont celles des clients avec lesquels l'intégration a été vérifiée. D'autres clients MCP stdio devraient fonctionner puisque le protocole est le même, mais nous ne les certifions pas individuellement. DocAI n'est ni affilié aux éditeurs de ces clients, ni approuvé par eux, ni leur partenaire.
DocAI MCP bêta
Ce que contient la première bêta publique :
- Un serveur MCP stdio local, distribué sur npm.
- Un installateur qui configure les hôtes MCP pris en charge, et une commande doctor qui vérifie le résultat.
- Vérifié avec Codex, Claude Code et Gemini CLI.
- Accès aux fichiers locaux limité à l'espace de travail.
- Des résultats d'extraction structurés et compacts.
- Un envoi de tâche idempotent : une nouvelle tentative ne traite pas deux fois le même document.
- Les limites de sécurité décrites ci-dessus.
Bêta signifie que la surface d'outils peut encore changer d'une version à l'autre. Épinglez une version dans les configurations durables.
Package
| Package | @synairo/docai-mcp |
|---|---|
| Éditeur | Synairo, l'organisation npm exploitée par SYNAIRO sp. z o.o., qui publie DocAI. |
| Bêta actuelle | 0.1.0-beta.1 |
| Canal d'intégration | next |
| Prérequis | Node.js 18.17 ou plus récent |
| npm | https://www.npmjs.com/package/@synairo/docai-mcp |
La configuration hôte durable générée par l'installateur fixe la version exacte, par exemple npx -y @synairo/docai-mcp@0.1.0-beta.1 serve, jamais le tag de canal next.
Les documents traités via MCP sont décomptés du même solde de pages que ceux de l'API REST, car ils passent par le même backend DocAI.