Pas un chatbot.
Un runtime pour agents IA persistants.
La plupart des agents IA répondent à une demande ponctuelle. Pumaï va plus loin : des agents qui vivent en arrière-plan, surveillent des sujets, exécutent des tâches planifiées, créent leurs propres outils, s'appuient sur une mémoire longue, appellent des services externes — et restent sous contrôle humain.
Une PME fictive. Un assistant qui travaille pour de vrai.
Pour éprouver Pumaï en conditions réelles mais sans enjeu pour un vrai client, nous avons confié la boîte mail d'une entreprise imaginaire — Nautilia Systems, un spécialiste d'électronique marine (balises GPS, télémétrie, supervision de bateaux et de ports de plaisance) — à un assistant entièrement autonome, qui tourne 24 h/24, sans intervention humaine.
Il lit et trie chaque e-mail entrant, qualifie les demandes de devis et crée les fiches prospects, suit les tickets de support et escalade les urgences, surveille la concurrence et la réputation en ligne, relance les impayés avec tact, et rédige chaque jour ses rapports de direction. Tout ce qu'une secrétaire commerciale ferait — en continu.
Le tout sous contrôle strict : aucun e-mail n'est envoyé à un destinataire non autorisé, et toute action engageante (devis, réponse commerciale, réclamation) part en brouillon soumis à validation. L'assistant ne promet jamais un prix, un délai ou une remise qui ne figure pas dans les règles ou les données qui lui ont été fournies.
une page de preuve de travail alimentée en temps réel par la vraie activité de l'instance — les noms et adresses sont masqués, et rien n'est mis en scène.
Un cadre d'exécution fiable pour agents qui agissent
Pumaï réunit dans un même runtime des briques rarement assemblées : autonomie, mémoire, outils, gouvernance et observabilité. Un agent peut recevoir une demande, chercher dans sa mémoire, retrouver du contexte par RAG, explorer des relations via Graph RAG, choisir des outils, produire un plan, exécuter des actions, demander validation si nécessaire, journaliser ce qu'il fait, puis consolider son expérience. C'est cette boucle complète qui manque souvent aux frameworks agentiques actuels.
Cloisonnés, mais coordonnés
Chaque profil garde sa mémoire privée, ses outils et ses canaux. Partagés à dessein : une armoire documentaire et l'annuaire de l'entreprise.
Multi-étages
Conversation récente, segments résumés, RAG vectoriel, Graph RAG relationnel — consolidés chaque nuit.
Orchestrateur / experts
Un orchestrateur planifie, des agents experts ReAct exécutent en vagues parallèles avec de vrais outils.
Heartbeat & Pulz
Surveiller, déclencher et suivre des missions sans attendre un prompt utilisateur.
Outils à la demande
Concevoir, tester, corriger et versionner des outils dans un bac à sable — plus des connecteurs MCP.
Native, pas un ajout
Validation humaine des actions sensibles, journal d'audit en ajout seul, quotas, cloisonnement — évalués à chaque appel d'outil.
la différence clé : Pumaï ne cherche pas à « faire parler une IA », mais à donner un cadre d'exécution fiable à des agents capables d'agir.
La plateforme vient de franchir un cap
Une vague d'ajouts majeurs rend Pumaï nettement plus puissant : un graphe de connaissances, un studio de création d'outils, des connecteurs MCP, une passerelle téléphonique (appels entrants/sortants), des réponses au fil de l'eau avec raisonnement visible, une interface désormais en anglais, et bien plus.
Plus qu'un assistant. Un runtime qui agit.
Les assistants classiques attendent, oublient et s'arrêtent au texte. Pumaï répond aux trois en même temps.
| axe | assistant classique | pumaï |
|---|---|---|
| Déclenchement | Passif — attend un prompt | Proactif — une boucle de fond, vit sans interaction humaine |
| Mémoire | Amnésique — fenêtre de contexte limitée | Sédimentaire — mémoire cloisonnée + consolidation nocturne |
| Action | Simule, ou s'arrête au texte | Agentique — un orchestrateur délègue à une équipe d'experts dotés d'outils réels |
| Gouvernance | Boîte noire incontrôlable | Boîte de verre — verrouillage conditionnel, validation humaine, audit en ajout seul |
autrement dit : Pumaï est moins un « assistant IA » qu'un système d'exploitation pour agents IA.
L'architecture, en un coup d'œil
Une API centrale résout le profil, assemble le contexte, applique sécurité et quota — puis route vers trois sous-systèmes : la mémoire, le moteur agentique, et la boucle de fond autonome.
socle technique — Python 3.12 · FastAPI · PostgreSQL + pgvector · client compatible OpenAI (fournisseur de modèle configurable) · Docker.
Votre assistant, vos règles, vos données
Pumaï se déploie en instance isolée : chaque client a la sienne — ses données, sa boîte mail, ses clés, sa configuration — isolée de celles des autres clients. Vous gardez la main de bout en bout.
Une instance par client
Vos données sont stockées dans une instance dédiée, isolée de celles des autres clients. Les traitements ou transferts vers des services externes (modèle IA, e-mail, téléphonie…) dépendent des fournisseurs et connecteurs que vous configurez.
Aucun fournisseur imposé
Pumaï n'est lié à aucun fournisseur d'IA : on choisit le modèle adapté à votre exigence de qualité, de coût ou de confidentialité — et le système raisonne dans n'importe quelle langue.
Vos outils, vos connecteurs
La liste des capacités n'est pas figée : outils sur mesure créés en bac à sable, connecteurs MCP vers vos services (messagerie, agenda, bases de données…). On ouvre un outil, l'assistant l'utilise.
Jamais une boîte noire
Chaque décision, chaque action et son coût sont journalisés et consultables : journal d'audit en ajout seul (append-only), trace d'exécution, quotas par instance. Une IA qui agit seule, mais toujours sous votre regard.
Ce qui vient d'arriver dans Pumaï
Graphe de connaissances
Au-delà du RAG vectoriel, la mémoire tisse désormais un graphe d'entités et de relations interrogeable — des réponses mieux reliées, une compréhension qui se structure dans le temps.
Studio de création d'outils
Concevez, testez et versionnez vos propres outils via un assistant guidé en bac à sable. L'agent gagne de nouvelles capacités, taillées pour vos besoins.
Connecteurs MCP
Branchez des serveurs MCP externes pour étendre l'agent : ajout manuel, recherche dans le registre npm, ou import direct par URL, paquet ou JSON.
Page Outils repensée
Une interface repensée, bien plus pratique, avec un Lock Manager qui rend enfin simple la validation et le blocage de chaque outil.
Passerelle téléphonique
Via Twilio, votre agent peut désormais recevoir et passer des appels — une voix qui répond, appelle et rend compte.
Réponses au fil de l'eau
Le message s'affiche au fur et à mesure que l'IA le rédige — fluide à l'écran, indispensable pour la voix en temps réel.
Trace d'exécution
Suivez la trace d'exécution de l'agent directement dans le chat — les étapes et la justification de ses décisions, pas seulement la réponse finale.
Journal plus puissant
La page de logs devient une vraie vue d'activité : sessions, exécutions et événements, pour comprendre ce que fait le système.
Interface en anglais
L'interface est désormais traduite en anglais (≈80 %, le reste arrive), ouvrant Pumaï à une communauté plus large.
Support intégré
Un bouton de support en bas de l'interface permet d'envoyer un message qui atterrit directement dans notre outil de suivi.
Compétences réutilisables
Apprenez un savoir-faire une seule fois — traiter un devis, gérer une réclamation, ouvrir un ticket — et l'assistant l'applique ensuite à l'identique. Un studio dédié les crée par simple entretien guidé et mesure le gain.
Une vraie boîte mail
L'assistant lit, classe, ouvre les pièces jointes, prépare des brouillons et envoie réellement ses réponses — mais jamais à un destinataire hors de votre liste blanche, avec l'option « brouillon soumis à validation ».
L'armoire documentaire
Un classeur central partagé : vous y déposez vos documents de référence, l'assistant y range ses productions (rapports, devis, PJ envoyées). Tout est daté, tracé, et son cycle de vie suivi (brouillon → à envoyer → envoyé).
Tableau de bord d'activité
Non pas un journal technique, mais un récit : objectif → déroulé → résultat. Missions en cours, chiffres du jour, temps et coût économisés — auditables et honnêtes (une consultation n'est jamais présentée comme une action).
Vitrine — preuve de travail
Une page qui raconte en direct, depuis le vrai journal du système, tout ce que l'assistant accomplit en autonomie — chiffres honnêtes, décisions, fichiers téléchargeables. Privée par défaut, publiable en un clic, données personnelles masquées.
La prochaine étape : des contextes deux fois plus légers
La prochaine grande avancée est déjà en chantier : représenter le contexte non plus comme un long texte à relire, mais comme un graphe de connaissances agrémenté de fragments de prompt — une forme bien plus compacte qui allège de 50 à 70 % le volume que l'assistant doit charger à chaque étape, sans perdre le fil. À la clé : des réponses plus rapides, un coût par action nettement réduit, et une mémoire de travail plus longue à budget égal.
C'est encore de la recherche & développement : le cap des 50 % de compression est déjà atteint en test, avec une compréhension quasi intacte. Le travail en cours vise ~60 % tout en gardant une compréhension quasi intacte. On avance, étape par étape.
prototype en test — pas encore en production.
Un runtime, quatre capacités
Il converse
Dialogue multi-canal (web, API, Telegram, Discord, téléphone) avec une mémoire qui s'étend sur des mois.
mémoire & apprentissage → 02 — agirIl agit
Il décompose les demandes complexes en une équipe d'agents experts dotés d'outils réels.
le moteur → 03 — vivre seulIl vit seul
Il tourne en continu : veilles, tâches planifiées, missions long terme — sans personne aux commandes.
autonomie & Pulsar → 04 — rester gouvernableIl reste maîtrisable
Gouvernance native, évaluée à chaque appel d'outil : validation humaine des actions sensibles, journal d'audit en ajout seul, quotas, cloisonnement.
la gouvernance →Une IA qui agit seule doit rester maîtrisable
Pumaï ne promet pas une IA magique et incontrôlable : il propose une infrastructure pour agents gouvernables. Chaque action peut être tracée. Chaque outil peut être limité. Chaque profil peut être isolé. Chaque décision sensible peut passer par une validation humaine. Et toute l'autonomie est débrayable — d'un seul interrupteur.
Parlons de votre projet
Vous avez un cas d'usage précis à cadrer, ou vous voulez voir Pumaï tourner sur votre activité ? Écrivez-nous — réponse individuelle sous 48 h.
Pas de liste de diffusion — juste une vraie conversation.