feat(chatbot): mode profondeur côté serveur (rapide / approfondi) sur les 4 routes

Contrat unique `profondeur` ('rapide' | 'approfondi', défaut rapide) dans
utils/chatProfondeur.ts (libellés partagés). Les 3 routes Bifrost lisent
body.profondeur ?? body.mode, choisissent le tier (20b / 120b + replis), un
prompt système « réflexion » (Entraide, Réseaux, Taff) au même format JSON, et un
budget max_tokens adapté. Pensées lit body.profondeur (jamais body.mode, réservé à
LightRAG) : posture réflexion ajoutée au user_prompt + max_total_tokens 40000.
Modèle servi journalisé, et champ debug exposé uniquement en dev.

Co-Authored-By: Claude Opus 5.5 <noreply@anthropic.com>
Claude-Session: https://claude.ai/code/session_015vcVGz8i4WpZm2dixKUiSD
This commit is contained in:
Jules Neny
2026-10-09 03:45:27 +02:00
co-authored by Claude Opus 5.5
parent 75d8440601
commit 80f69565aa
6 changed files with 198 additions and 19 deletions
+32 -1
View File
@@ -6,6 +6,7 @@
import { readFileSync } from 'node:fs'
import { join } from 'node:path'
import { checkRateLimitJson } from '~/server/utils/rateLimitJson'
import { profondeurDuBody, REGLE_GUILLEMETS } from '~/server/utils/bifrost'
/**
* Règle citations — commune aux 4 préambules (mesure M7 du 05/10 : le modèle invente des
@@ -50,6 +51,28 @@ Règles :
- Ton praticien militant : direct, pas neutre, ancré dans la pratique architecturale.
- Réponse en français, dense, sans délayage.`
/**
* Posture « réflexion » (mode approfondi, v1 — prompts définitifs par onglet : B7/B9).
* Ajoutée APRÈS le préambule du corpus et AVANT REGLE_CITATIONS (qui reste prioritaire).
* Pensées n'est pas servi par Bifrost : le LLM de génération est réglé côté LightRAG, donc
* ce mode change la consigne et les paramètres de récupération, pas le modèle.
*/
const POSTURE_REFLEXION = `MODE RÉFLEXION : l'usager veut penser, pas seulement s'informer.
- Mets les idées en relation : reformule d'abord ce que la question engage, puis fais dialoguer les auteurs et les écoles présents dans le contexte.
- Nomme les tensions et les désaccords entre écoles (ce qu'elles partagent, là où elles divergent, ce que chacune ne voit pas), sans trancher à la place de l'usager.
- Reste strictement dans le corpus fourni : si une idée n'y est pas, dis-le au lieu de la compléter de mémoire.
- Termine par 2 questions ouvertes qui aident l'usager à situer sa propre position.
- Réponse structurée en paragraphes courts, 450 mots maximum.
- ${REGLE_GUILLEMETS}`
/**
* Paramètres de récupération LightRAG du mode réflexion. Mesuré le 09/10 (contexte seul, hybrid) :
* top_k 60 / chunk_top_k 30 ne changent rien (115,7 → 115,9 Ko, le budget de tokens plafonne) ;
* max_total_tokens 50000 monte le contexte à 153 Ko. On prend 40000 : plus de matière pour croiser
* les écoles sans approcher la fenêtre du LLM de génération (réglé côté serveur).
*/
const PARAMS_RAG_REFLEXION = { max_total_tokens: 40000 }
function buildPrefaceAuteur(nomAuteur: string, slug: string): string {
return `Tu réponds EXCLUSIVEMENT depuis les livres de ${nomAuteur} présents dans le RAG (fichiers commençant par "${slug}__").
Si la question sort du périmètre de cet auteur, indique-le et propose de l'aborder sans le hashtag pour interroger la carte entière. Reste fidèle au style et à la pensée de ${nomAuteur}. Cite toujours le livre.
@@ -98,6 +121,8 @@ export default defineEventHandler(async (event) => {
}
const query: string = body.query.trim()
// jamais body.mode ici : réservé au mode de recherche LightRAG (hybrid…)
const profondeur = profondeurDuBody({ profondeur: body.profondeur })
const mode: string = body.mode || 'hybrid'
const corpus: string = body.corpus || 'pensees'
const ragUrl: string = (config.ragPeUrl as string) || 'http://localhost:9621'
@@ -133,8 +158,11 @@ export default defineEventHandler(async (event) => {
const ragBody: Record<string, any> = {
query,
mode,
user_prompt: `${systemPreface}\n\n${REGLE_CITATIONS}`,
user_prompt: profondeur === 'approfondi'
? `${systemPreface}\n\n${POSTURE_REFLEXION}\n\n${REGLE_CITATIONS}`
: `${systemPreface}\n\n${REGLE_CITATIONS}`,
}
if (profondeur === 'approfondi') Object.assign(ragBody, PARAMS_RAG_REFLEXION)
if (auteurSlug && nomAuteurMatch) {
ragBody.hl_keywords = [nomAuteurMatch, auteurSlug]
ragBody.ll_keywords = [auteurSlug]
@@ -174,5 +202,8 @@ export default defineEventHandler(async (event) => {
auteur_chunks: auteurSlug && nomAuteurMatch ? { on_target: chunksOnTarget, off_target: chunksOffTarget } : null,
filter: { couche: body.filter_couche ?? null, ecole: body.filter_ecole ?? null },
timestamp: new Date().toISOString(),
...(import.meta.dev
? { debug: { profondeur, user_prompt_chars: ragBody.user_prompt.length, rag_params: profondeur === 'approfondi' ? PARAMS_RAG_REFLEXION : null } }
: {}),
}
})