Orchestration LLM local-first avec repli cloud
Qwen 2.5 14B sur matériel ROCm grand public à ~63 tok/s, Claude Haiku en repli, un registre d'outils modulaire et une table de routage d'intentions qui sépare intentions directes et contextuelles.
- Qwen 2.5 14B
- ROCm
- Claude Haiku
- tool registry
Un compagnon qui connaît vraiment ta bibliothèque
Un chat en streaming qui appelle de vrais catalogues pour des titres que tu ne possèdes pas encore, garde un profil de goûts persistant, relie anime, manga et livres et rend des cartes actionnables — Claude Haiku par défaut, Sonnet à la demande.
- Claude API
- NDJSON streaming
- taste memory
Un assistant IA intégré et un classement de contenu
Conception de l'assistant IA intégré et de la logique de classement de contenu qui façonne ce que voient créateurs et audiences.
- LLM orchestration
- content ranking
Claude dans un vrai produit : assistant, vision, prix
Un assistant propulsé par Claude répond aux questions sur le projet, la vision transforme un ticket photographié en lignes de dépense, et des suggestions de prix aident à remplir l'estimé — une intégration LLM concrète branchée sur le modèle métier, pas plaquée par-dessus.
- Claude API
- vision receipt scan
- price suggestions
Notion / MCP pipeline
2025 — présent
Des workflows agentiques qui tiennent sur six projets
Un motif de table-file — une contrainte de schéma délibérée — a supprimé toute une classe d'échecs d'agent sur le filtrage de propriétés, rendant le pipeline assez fiable pour tourner chaque jour sur six projets actifs.
- MCP
- Claude Code
- queue-table pattern