autonome · gouvernable · souverain

Pas un chatbot.
Un runtime pour agents IA persistants.

La plupart des agents IA répondent à une demande ponctuelle. Pumaï va plus loin : des agents qui vivent en arrière-plan, surveillent des sujets, exécutent des tâches planifiées, créent leurs propres outils, s'appuient sur une mémoire longue, appellent des services externes — et restent sous contrôle humain.

24/7autonomie de fond
~50outils réels
3étages de mémoire
0fuite entre clients
— simulation en condition réelle

Une PME fictive. Un assistant qui travaille pour de vrai.

Pour éprouver Pumaï en conditions réelles mais sans enjeu pour un vrai client, nous avons confié la boîte mail d'une entreprise imaginaire — Nautilia Systems, un spécialiste d'électronique marine (balises GPS, télémétrie, supervision de bateaux et de ports de plaisance) — à un assistant entièrement autonome, qui tourne 24 h/24, sans intervention humaine.

Il lit et trie chaque e-mail entrant, qualifie les demandes de devis et crée les fiches prospects, suit les tickets de support et escalade les urgences, surveille la concurrence et la réputation en ligne, relance les impayés avec tact, et rédige chaque jour ses rapports de direction. Tout ce qu'une secrétaire commerciale ferait — en continu.

Le tout sous contrôle strict : aucun e-mail n'est envoyé à un destinataire non autorisé, et toute action engageante (devis, réponse commerciale, réclamation) part en brouillon soumis à validation. L'assistant ne promet jamais un prix, un délai ou une remise qui ne figure pas dans les règles ou les données qui lui ont été fournies.

une page de preuve de travail alimentée en temps réel par la vraie activité de l'instance — les noms et adresses sont masqués, et rien n'est mis en scène.

— ce que c'est

Un cadre d'exécution fiable pour agents qui agissent

Pumaï réunit dans un même runtime des briques rarement assemblées : autonomie, mémoire, outils, gouvernance et observabilité. Un agent peut recevoir une demande, chercher dans sa mémoire, retrouver du contexte par RAG, explorer des relations via Graph RAG, choisir des outils, produire un plan, exécuter des actions, demander validation si nécessaire, journaliser ce qu'il fait, puis consolider son expérience. C'est cette boucle complète qui manque souvent aux frameworks agentiques actuels.

profils cloisonnés

Cloisonnés, mais coordonnés

Chaque profil garde sa mémoire privée, ses outils et ses canaux. Partagés à dessein : une armoire documentaire et l'annuaire de l'entreprise.

mémoire longue

Multi-étages

Conversation récente, segments résumés, RAG vectoriel, Graph RAG relationnel — consolidés chaque nuit.

moteur agentique

Orchestrateur / experts

Un orchestrateur planifie, des agents experts ReAct exécutent en vagues parallèles avec de vrais outils.

autonomie de fond

Heartbeat & Pulz

Surveiller, déclencher et suivre des missions sans attendre un prompt utilisateur.

studio d'outils

Outils à la demande

Concevoir, tester, corriger et versionner des outils dans un bac à sable — plus des connecteurs MCP.

gouvernance

Native, pas un ajout

Validation humaine des actions sensibles, journal d'audit en ajout seul, quotas, cloisonnement — évalués à chaque appel d'outil.

la différence clé : Pumaï ne cherche pas à « faire parler une IA », mais à donner un cadre d'exécution fiable à des agents capables d'agir.

— nouveautés

La plateforme vient de franchir un cap

Une vague d'ajouts majeurs rend Pumaï nettement plus puissant : un graphe de connaissances, un studio de création d'outils, des connecteurs MCP, une passerelle téléphonique (appels entrants/sortants), des réponses au fil de l'eau avec raisonnement visible, une interface désormais en anglais, et bien plus.

découvrir les nouvelles capacités →

— rupture de paradigme

Plus qu'un assistant. Un runtime qui agit.

Les assistants classiques attendent, oublient et s'arrêtent au texte. Pumaï répond aux trois en même temps.

axe assistant classique pumaï
Déclenchement Passif — attend un prompt Proactif — une boucle de fond, vit sans interaction humaine
Mémoire Amnésique — fenêtre de contexte limitée Sédimentaire — mémoire cloisonnée + consolidation nocturne
Action Simule, ou s'arrête au texte Agentique — un orchestrateur délègue à une équipe d'experts dotés d'outils réels
Gouvernance Boîte noire incontrôlable Boîte de verre — verrouillage conditionnel, validation humaine, audit en ajout seul

autrement dit : Pumaï est moins un « assistant IA » qu'un système d'exploitation pour agents IA.

— architecture

L'architecture, en un coup d'œil

Une API centrale résout le profil, assemble le contexte, applique sécurité et quota — puis route vers trois sous-systèmes : la mémoire, le moteur agentique, et la boucle de fond autonome.

Web
API REST
Telegram
Discord
Téléphone
API centrale · FastAPI résolution du profil · assemblage du contexte · sécurité · quota de tokens
à chaque requête ↓
mémoire
Mémoire narrativepersona · voix · faits durables
PostgreSQL + pgvectorsegments · RAG (HNSW 1024-d) · Graph RAG
moteur agentique
Orchestrateurplanifie, n'exécute jamais
Agents expertsboucles ReAct · ~50 outils · MCP
Lock Managerarbitre chaque action sensible
boucle de fond
Heartbeattick toutes les N min → Pulz
Planificateurrêves nocturnes · auto-analyse
Canaux sortants e-mail (SMTP) · Telegram · web · téléphone — chaque action externe passe par le Lock Manager
carte générale — canaux → API → mémoire · action · autonomie → sorties

socle technique — Python 3.12 · FastAPI · PostgreSQL + pgvector · client compatible OpenAI (fournisseur de modèle configurable) · Docker.

— souverain & sur-mesure

Votre assistant, vos règles, vos données

Pumaï se déploie en instance isolée : chaque client a la sienne — ses données, sa boîte mail, ses clés, sa configuration — isolée de celles des autres clients. Vous gardez la main de bout en bout.

données cloisonnées

Une instance par client

Vos données sont stockées dans une instance dédiée, isolée de celles des autres clients. Les traitements ou transferts vers des services externes (modèle IA, e-mail, téléphonie…) dépendent des fournisseurs et connecteurs que vous configurez.

modèle au choix

Aucun fournisseur imposé

Pumaï n'est lié à aucun fournisseur d'IA : on choisit le modèle adapté à votre exigence de qualité, de coût ou de confidentialité — et le système raisonne dans n'importe quelle langue.

extensible

Vos outils, vos connecteurs

La liste des capacités n'est pas figée : outils sur mesure créés en bac à sable, connecteurs MCP vers vos services (messagerie, agenda, bases de données…). On ouvre un outil, l'assistant l'utilise.

traçable

Jamais une boîte noire

Chaque décision, chaque action et son coût sont journalisés et consultables : journal d'audit en ajout seul (append-only), trace d'exécution, quotas par instance. Une IA qui agit seule, mais toujours sous votre regard.

— nouvelles capacités

Ce qui vient d'arriver dans Pumaï

01 — mémoire

Graphe de connaissances

Au-delà du RAG vectoriel, la mémoire tisse désormais un graphe d'entités et de relations interrogeable — des réponses mieux reliées, une compréhension qui se structure dans le temps.

02 — action

Studio de création d'outils

Concevez, testez et versionnez vos propres outils via un assistant guidé en bac à sable. L'agent gagne de nouvelles capacités, taillées pour vos besoins.

03 — action

Connecteurs MCP

Branchez des serveurs MCP externes pour étendre l'agent : ajout manuel, recherche dans le registre npm, ou import direct par URL, paquet ou JSON.

04 — contrôle

Page Outils repensée

Une interface repensée, bien plus pratique, avec un Lock Manager qui rend enfin simple la validation et le blocage de chaque outil.

05 — canaux

Passerelle téléphonique

Via Twilio, votre agent peut désormais recevoir et passer des appels — une voix qui répond, appelle et rend compte.

06 — expérience

Réponses au fil de l'eau

Le message s'affiche au fur et à mesure que l'IA le rédige — fluide à l'écran, indispensable pour la voix en temps réel.

07 — transparence

Trace d'exécution

Suivez la trace d'exécution de l'agent directement dans le chat — les étapes et la justification de ses décisions, pas seulement la réponse finale.

08 — observabilité

Journal plus puissant

La page de logs devient une vraie vue d'activité : sessions, exécutions et événements, pour comprendre ce que fait le système.

09 — international

Interface en anglais

L'interface est désormais traduite en anglais (≈80 %, le reste arrive), ouvrant Pumaï à une communauté plus large.

10 — support

Support intégré

Un bouton de support en bas de l'interface permet d'envoyer un message qui atterrit directement dans notre outil de suivi.

11 — compétences

Compétences réutilisables

Apprenez un savoir-faire une seule fois — traiter un devis, gérer une réclamation, ouvrir un ticket — et l'assistant l'applique ensuite à l'identique. Un studio dédié les crée par simple entretien guidé et mesure le gain.

12 — action

Une vraie boîte mail

L'assistant lit, classe, ouvre les pièces jointes, prépare des brouillons et envoie réellement ses réponses — mais jamais à un destinataire hors de votre liste blanche, avec l'option « brouillon soumis à validation ».

13 — mémoire

L'armoire documentaire

Un classeur central partagé : vous y déposez vos documents de référence, l'assistant y range ses productions (rapports, devis, PJ envoyées). Tout est daté, tracé, et son cycle de vie suivi (brouillon → à envoyer → envoyé).

14 — transparence

Tableau de bord d'activité

Non pas un journal technique, mais un récit : objectif → déroulé → résultat. Missions en cours, chiffres du jour, temps et coût économisés — auditables et honnêtes (une consultation n'est jamais présentée comme une action).

15 — preuve

Vitrine — preuve de travail

Une page qui raconte en direct, depuis le vrai journal du système, tout ce que l'assistant accomplit en autonomie — chiffres honnêtes, décisions, fichiers téléchargeables. Privée par défaut, publiable en un clic, données personnelles masquées.

— en développement

La prochaine étape : des contextes deux fois plus légers

La prochaine grande avancée est déjà en chantier : représenter le contexte non plus comme un long texte à relire, mais comme un graphe de connaissances agrémenté de fragments de prompt — une forme bien plus compacte qui allège de 50 à 70 % le volume que l'assistant doit charger à chaque étape, sans perdre le fil. À la clé : des réponses plus rapides, un coût par action nettement réduit, et une mémoire de travail plus longue à budget égal.

C'est encore de la recherche & développement : le cap des 50 % de compression est déjà atteint en test, avec une compréhension quasi intacte. Le travail en cours vise ~60 % tout en gardant une compréhension quasi intacte. On avance, étape par étape.

prototype en test — pas encore en production.

— la boîte de verre

Une IA qui agit seule doit rester maîtrisable

Pumaï ne promet pas une IA magique et incontrôlable : il propose une infrastructure pour agents gouvernables. Chaque action peut être tracée. Chaque outil peut être limité. Chaque profil peut être isolé. Chaque décision sensible peut passer par une validation humaine. Et toute l'autonomie est débrayable — d'un seul interrupteur.

la gouvernance en détail →

— aller plus loin

Parlons de votre projet

Vous avez un cas d'usage précis à cadrer, ou vous voulez voir Pumaï tourner sur votre activité ? Écrivez-nous — réponse individuelle sous 48 h.

Pas de liste de diffusion — juste une vraie conversation.

réponse individuelle — pas de liste de diffusion

Vos données (prénom, e-mail, message) servent uniquement à répondre à votre demande, par le responsable de traitement (Polymathe SI). Voir la politique de confidentialité.

message reçu — réponse sous 48 h
erreur lors de l'envoi — réessayez