Modèles et inférence
Nous travaillons avec l'ensemble des familles de modèles : les grandes API commerciales comme les modèles open source et privés. Le choix se fait cas d'usage par cas d'usage, sur des critères mesurés : qualité des sorties, latence, coût par requête, exigences de confidentialité.
Les prompts sont versionnés comme du code. Quand un modèle est déprécié ou qu'une nouvelle version sort, la bascule est testée avant d'être déployée, pas subie.









