Vos Documents, Indexés Sémantiquement
Déposez n'importe quel document dans votre espace de connaissance privé — PDF, Word, CSV ou image. Chaque fichier est indexé sémantiquement, auto-taggé et lié aux nœuds du graphe, stocké chiffré sur site.
§1 — Formats supportés & pipeline d'ingestion
Chaque fichier passe par un pipeline d'ingestion sémantique — pas uniquement du stockage.
PDF & Word
Extraction de texte intégrale, détection des sections et reconnaissance de concepts. Chaque paragraphe significatif mappe vers un ou plusieurs nœuds du graphe.
CSV & Excel
Les données tabulaires sont parsées ligne par ligne en triples RDF. Les en-têtes de colonnes deviennent des URI de propriétés — les données sont immédiatement requêtables en SPARQL.
Images (OCR)
L'OCR sur site extrait le texte des documents scannés, tableaux blancs et diagrammes. Le texte extrait est indexé comme n'importe quel fichier natif.
Stockage chiffré sur site
Les fichiers sont chiffrés AES-256 au repos dans MinIO, à l'intérieur de votre périmètre d'infrastructure. Aucun contenu ne quitte jamais le cluster privé.
Auto-tagging
Le LLM sur site assigne des tags sémantiques issus de votre ontologie à chaque fichier déposé, le reliant aux nœuds existants de votre graphe personnel.
Liaison aux nœuds du graphe
Chaque fichier devient une ressource arcaq:PersonalFile avec des arêtes vers ses concepts auto-détectés — navigable depuis la vue graphe.
§2 — Modèle de données RDF
Chaque fichier est une ressource RDF de première classe dans votre graphe nommé privé — entièrement requêtable et portable.
§3 — Référence API
Toutes les opérations sur fichiers sont exposées via l'API REST du Second Brain sous /second-brain/files.
| Méthode | Endpoint | Description |
|---|---|---|
| POST | /second-brain/files | Déposer un fichier (multipart/form-data) — déclenche le pipeline d'ingestion en asynchrone |
| GET | /second-brain/files | Lister tous les fichiers personnels avec métadonnées et auto-tags |
| GET | /second-brain/files/{id} | Obtenir une ressource fichier avec ses liens dans le graphe |
| GET | /second-brain/files/{id}/download | Télécharger le fichier original (déchiffré) en streaming |
| DELETE | /second-brain/files/{id} | Supprimer le fichier et tous les triples RDF associés du graphe personnel |
Faites de chaque document un nœud de connaissance
Fini la recherche dans les arborescences de dossiers. Déposez une fois — vos documents deviennent des nœuds requêtables, liés à chaque concept de votre Second Brain.