2026
RAG en production : du POC au scale sur VCF
La plupart des POCs RAG meurent entre la démo et la prod. On parcourt l'écart — chunking, fraîcheur, evals, observabilité — sur VCF et VKS.
Bases vectorielles sur VKS : pgvector, Milvus, Weaviate
Tout RAG a besoin d'un vector store. On compare pgvector, Milvus et Weaviate sur VKS — qualité d'index, surface ops, et celui qui colle vraiment à ton équipe.
GPU pooling sur VCF : NVIDIA vGPU + MIG en pratique
Mutualiser les GPU est la seule manière de rendre les maths du private AI tenables. On parcourt les profils vGPU, le slicing MIG et les pièges du scheduling mixte.
Private AI sur VCF : l'architecture qui rentre dans ton DC
VCF Private AI Foundation est la stack que Broadcom propose pour héberger LLMs et inférence dans ton propre DC. On la décortique couche par couche.