YARP.DEV
← Tous les projets

Passerelle IA multi-tenant · Ingénierie de plateforme

QWEN Hosting

Un backend IA privé et partagé qui centralise l’accès aux modèles, le contexte tenant/application, les outils, le RAG et l’observabilité.

Ce que le produit cherche à résoudre

Fournit une passerelle IA gouvernée pour plusieurs applications tout en gardant modèles et runtimes remplaçables et pilotés par politiques.

À qui le système s’adresse

  • Équipes produit internes
  • Applications tenant
  • Services enrichis par IA

Comment le système est structuré

Patterns et frontières

Multi-tenancy · AI Gateway · Model routing · Tools · RAG · Local-first inference

Frontend

Administration / observability surfaces

Backend

Gateway APIs · Policy / model router · Tool orchestration

Infrastructure

Local models · Cloud fallback · Observability · Cost-awareness

Des problèmes qui méritent d’être montrés

  1. 1

    Application → AI Gateway → Policy / Model Router → Model / Tools / RAG

  2. 2

    Inférence local-first avec repli cloud

  3. 3

    Indépendance modèle/runtime entre applications