Cahier d'établissement · Pour décider

Mistral, Llama, Qwen, LLaVA, Whisper, embeddings

L'IA locale, sans abonnement.

Mistral 7B français par défaut, pour la souveraineté. Liberté totale du modèle : Llama 3, Qwen, DeepSeek, Phi. Vos données ne quittent jamais le Mac Mini.

« On a interdit ChatGPT après qu'un commercial ait collé un brouillon de contrat dedans. Mais on perd la productivité. Vous proposez quoi ? »

— Le DSI d'un cabinet de conseil, en avant-vente

Tout ce qui est inclus.

Le détail concret de ce qui tourne dans le module, livré par défaut.

Mistral 7B par défaut

  • Modèle français Apache 2.0, hébergé localement
  • Latence < 2 s sur Mac Mini M4
  • Spécialisé pour le métier (compta, RH, hôtellerie)
  • Souveraineté française : modèle conçu en France
  • Aucune télémétrie, aucun appel sortant
  • Mise à jour modèle au choix (vous validez)

Liberté du modèle (Ollama)

  • Llama 3 (Meta) pour les tâches généralistes
  • Qwen 2.5 (Alibaba) pour le code et le multilingue
  • DeepSeek pour le raisonnement long
  • Phi-3 (Microsoft) pour les contraintes mémoire
  • Swap modèle en une commande, aucun lock-in
  • Mix modèles par tâche (Mistral pour FR, Qwen pour code)

Vision, voix, embeddings

  • LLaVA pour analyser images (facture, étiquette, contrôle qualité)
  • Whisper pour transcrire les appels et réunions
  • nomic-embed pour la recherche sémantique sur vos docs
  • Synthèse vocale (Piper TTS) pour briefs audio
  • Tous les 4 tournent en parallèle sur Mac Mini M4
  • GPU Apple Silicon utilisé (Metal Performance Shaders)

Votre IA, votre modèle, votre machine.

Inclus dans PrivateCore.

Ce module fait partie de votre configuration : rien à activer, aucun surcoût caché. Votre tarif suit ce que vous utilisez vraiment.

Voir les tarifs et commander

S'intègre avec.

On remplace, ou on se branche. Les outils que vous utilisez déjà, connectés proprement.

  • Ollama
  • Mistral
  • Llama 3
  • Qwen 2.5
  • LLaVA
  • Whisper
  • nomic-embed

Questions fréquentes.

Les questions que les dirigeants posent en avant-vente sur ce module.

Pourquoi Mistral plutôt que GPT-4 ?

GPT-4 est puissant mais : (1) hébergé aux USA / Microsoft Azure, vos prompts transitent par leurs serveurs ; (2) abonnement perpétuel ~25 €/utilisateur/mois ; (3) lock-in éditeur. Mistral est français, open source Apache 2.0, gratuit, tourne en local. Pour 95 % des cas métier, la qualité suffit largement.

Quels modèles tournent sur quel matériel ?

Mac Mini M4 16 Go : Mistral 7B, Llama 3 8B, Qwen 2.5 7B, LLaVA, Whisper. Mac Mini M4 Pro 24 Go : ajout Mixtral 8x7B, DeepSeek-V2 16B. Mac Studio M4 Max : Mixtral 8x22B, Llama 3 70B (quantifié 4-bit).

Et les nouveaux modèles (Claude, Gemini) ?

Claude (Anthropic) et Gemini (Google) sont propriétaires, fermés, hébergés cloud. PrivateCore ne s'y connecte pas par principe (souveraineté). Toute IA open source téléchargeable via Ollama est supportée.

Pour de la génération créative (marketing, copywriting) ?

Mistral 7B fait l'affaire pour le métier. Pour du copywriting créatif en français long, on recommande Mistral Medium en mode "par lots" (asynchrone) ou Mixtral 8x7B sur Mac Mini Pro.

Combien de tokens / seconde sur Mac Mini ?

Mistral 7B Q4 : ~25 tok/s sur Mac Mini M4 (16 Go). LLaVA : ~3 s par image. Whisper : ~5× temps réel (5 min audio en 1 min). Tous saturent peu la machine en usage métier.

RGPD / IA Act EU sur l'usage des données ?

Vos données ne quittent jamais votre infrastructure. Aucun "data processing" externe à déclarer. Pas de DPA tiers à signer. C'est précisément l'inverse de ChatGPT Enterprise (DPA + transferts USA + Schrems II).

Une question sur ce module ?

On répond le jour même. Trente minutes, à votre rythme, sans engagement.

Voir l'IA locale en démo 30 min

Prêt à reprendre le contrôle ?

Une installation sur mesure, une réponse même jour, et votre Mac Mini livré en J+1.