reflexion
reflexion
¶
La réflexion à deux vitesses — brouillon, critique, version finale.
Demandé le 23 août 2026 : « rendre Diapason plus intelligent ». Un modèle de 9 milliards de paramètres ne raisonne pas mieux qu'il n'est né, mais il peut se RELIRE : sur les questions qui méritent réflexion, le serveur produit un brouillon en silence, demande au modèle de le critiquer, et ne diffuse que la version corrigée. Une deuxième passe vaut des milliards de paramètres — au prix d'un délai avant le premier mot, que l'on ne paie que sur les questions analytiques (voir meriter_reflexion).
Deux vitesses : la section [reflexion] de la config peut désigner un modèle plus grand pour ces tours-là (sur cette machine, qwen3:14b cohabite en mémoire avec le 9b du quotidien — aucune éviction, la voix reste chaude). Un modèle absent ou en panne retombe sans bruit sur le chemin ordinaire : la réflexion est un bonus, jamais une porte.
Le chemin vocal n'entre JAMAIS ici : sa latence est sa politesse.
Classes¶
Functions:¶
meriter_reflexion
¶
Vrai quand la question mérite un brouillon et une relecture.
Deux portes : une tournure analytique explicite, ou une question longue (60 mots et plus) — quelqu'un qui écrit un paragraphe attend mieux qu'un premier jet.
Source code in src/diapason/server/reflexion.py
modele_de_reflexion
¶
Le modèle des tours réfléchis : celui de la config, sinon le même.
Source code in src/diapason/server/reflexion.py
messages_de_critique
¶
La conversation augmentée du brouillon et de l'ordre de relecture.
Source code in src/diapason/server/reflexion.py
repondre_en_reflechissant
async
¶
repondre_en_reflechissant(
engine: Any,
modele: str,
messages: Sequence[Message],
*,
temperature: float,
max_tokens: int,
modele_de_secours: str = "",
) -> AsyncIterator[str]
Brouillon en silence, puis la version corrigée diffusée en flux.
Toute panne du brouillon (modèle absent, moteur grognon) retombe sur le flux ordinaire avec le modèle de secours : l'usager reçoit toujours une réponse, la réflexion n'est jamais une porte fermée.