Services IA

De votre besoin à un système IA exploitable

Je conçois, intègre et industrialise des solutions GenAI, RAG, agentiques et Machine Learning : sur AWS comme dans vos infrastructures privées ou isolées.

  1. Cadrer

    Besoin · données · contraintes

  2. Construire

    Modèles · RAG · agents · APIs

  3. Déployer

    Cloud · on-premise · CI/CD

  4. Exploiter

    Évaluer · observer · optimiser

Concevoir

GenAI, RAG & agents IA

Assistants sourcés, workflows agentiques et automatisations outillées, avec contrôle des actions.

  • RAG hybride
  • Tool calling & MCP
  • Guardrails & validation
Intégrer

Architecture & AI Engineering

Du cadrage technique aux APIs robustes, intégrées à vos données, outils et services internes.

  • Architecture cible
  • Python & FastAPI
  • APIs & connecteurs SI
Servir

Serving LLM & IA souveraine

Modèles open-weight optimisés sur GPU, dans le cloud privé comme en environnement isolé.

  • vLLM & H100
  • Quantification & cache
  • On-premise & air-gapped
Industrialiser

AWS, MLOps & LLMOps

Environnements reproductibles, déploiements automatisés et exploitation observable.

  • Bedrock & ECS
  • Terraform & Docker
  • CI/CD & CloudWatch
Fiabiliser

Évaluation, sécurité & observabilité

Qualité, sécurité et performance suivies tout au long du cycle de vie.

  • Factualité & benchmarks
  • Charge & latence
  • Traçabilité & monitoring
Prédire

Machine Learning & Data

Modèles prédictifs et outils d’analyse pour transformer les données en décisions concrètes.

  • Scikit-learn & XGBoost
  • Pandas & SQL
  • Streamlit & Power BI

Quelques résultats en production

0,95 Recall@7 sur un RAG de conformité en production
×1,8 de débit sur un serving vLLM, avec 40 % de coût d’inférence en moins à latence constante
Moins d’une heure pour provisionner un environnement AWS complet

Tarif & modalités

Un cadre clair, du cadrage à la production.

Un TJM de référence et un périmètre défini en amont, pour une mission ciblée, un renfort d’équipe ou un projet de bout en bout.

2× AWS Certified · Cloud & on-premise · Paris et à distance

TJM de référence

550 € HT / jour

Du cadrage à la production.

Mission ciblée · Renfort d’équipe · Projet de bout en bout

Cadre d’intervention

  • Périmètre, charge et livrables définis en amont
  • À distance, hybride ou sur site
  • Cloud, infrastructure privée ou environnement isolé
  • Déplacements hors Île-de-France chiffrés séparément

Budget total défini par devis selon le nombre de jours convenus. Documentation et livrables techniques intégrés au périmètre.