←

Performances

Configurez la qualité, la vitesse, les coûts, le cache et la sélection automatique des modèles.

Vue générale

Optimisation du Marcus Brain

Ces paramètres prépareront le comportement général du Model Manager et du Cost Manager.

Équilibré Profil actif
Automatique Sélection du modèle
Activé Cache intelligent
Activé Réponses en streaming
Aucun agent ne choisira directement OpenAI, Gemini, Anthropic, Mistral ou Marcus Server. Toute sélection passera par le Model Manager.
Profil

Mode de fonctionnement

Choisissez le compromis général appliqué aux conversations et aux agents.

Model Manager

Sélection des modèles

Sélection automatique du modèle Laisser le Model Manager choisir le modèle adapté à chaque tâche.
Autoriser le changement de fournisseur Permettre au Model Manager de changer de fournisseur en cas de besoin.
Réessayer automatiquement Relancer une requête temporairement échouée avant de changer de modèle.
Respecter la résidence des données Écarter les fournisseurs incompatibles avec les règles du projet ou de l’organisation.
Indication transmise au Model Manager, jamais un fournisseur imposé directement.
Politique appliquée lorsqu’un modèle est temporairement indisponible.
Fournisseurs

Disponibilité prévue

OpenAI

Fournisseur externe accessible uniquement via le Model Manager.

Disponible

Marcus Server

Infrastructure propriétaire future pour les modèles hébergés par Marcus-IA.

Prévu

Modèles locaux

Exécution privée sur infrastructure compatible ou serveur client.

Prévu

Autres fournisseurs

Anthropic, Google, Mistral ou tout provider futur compatible.

Extensible
Réponses

Vitesse et affichage

Réponses en streaming Afficher progressivement la réponse pendant sa génération.
Précharger les conversations récentes Charger les données utiles avant l’ouverture complète d’une conversation.
Réponses courtes par défaut Favoriser des réponses plus concises lorsque la tâche ne demande pas de détail.
Limite avant tentative de récupération ou changement de modèle.
Nombre maximal d’opérations simultanées pour un même utilisateur.
Cache

Cache intelligent

Activer le cache Réutiliser les résultats compatibles afin de réduire le temps et le coût.
Cache des connaissances Conserver temporairement les recherches et extraits fréquemment utilisés.
Cache des outils Réutiliser uniquement les résultats d’outils encore valides.
Exclure les données sensibles Ne jamais placer dans le cache partagé les secrets ou données protégées.
Durée générale avant invalidation automatique.
Le Permission Manager contrôlera chaque accès au cache.
Contexte

Gestion des conversations longues

Résumés automatiques Résumer les anciennes parties d’une conversation pour préserver les performances.
Checkpoints de conversation Créer des points de reprise lors des longues tâches ou conversations.
Compression intelligente du contexte Réduire le contenu transmis au modèle sans perdre les informations importantes.
Niveau d’utilisation du contexte avant création d’un résumé.
Définit la fréquence des points de reprise.
Limites

Protection des ressources

Limite technique indicative gérée par le Context Manager.
Nombre maximal indicatif de tâches IA par jour.
Budget indicatif transmis au Cost Manager.
Action appliquée lors du dépassement d’une limite.
Alertes avant dépassement Prévenir avant d’atteindre les limites de coût ou de consommation.
Réduction automatique des coûts Utiliser des modèles plus économiques lorsque le budget devient faible.
Marcus Server

Infrastructure propriétaire future

Préférer Marcus Server Utiliser en priorité l’infrastructure Marcus-IA lorsqu’elle sera disponible.
Repli vers un fournisseur externe Autoriser un fournisseur externe si Marcus Server est indisponible.
Traitement local des données sensibles Préférer une infrastructure privée pour les données classifiées sensibles.
Ces options préparent l’architecture. Elles ne lancent actuellement aucun modèle local et ne contournent pas le Model Manager.
Réglages avancés

Ajustement du compromis

70 %
Influence le choix des modèles les plus performants.
50 %
Influence la réduction des coûts et la sélection de modèles légers.
60 %
Influence le temps de réponse attendu.
90 %
Influence le choix d’une infrastructure privée ou locale.
Paramètres de performances enregistrés.