
Loading comments…
Récompense
Infos du projet
Mots-clés du produit
Mistral 3 est la nouvelle génération de modèles d'IA multimodaux et multilingues ouverts de Mistral. Cette version comprend trois modèles denses, petits et à la pointe de la technologie (14B, 8B et 3B paramètres) ainsi que Mistral Large 3 – le modèle le plus performant à ce jour – un modèle à mélange d'experts (MoE) clairsemé, entraîné avec 41B de paramètres actifs et 675B de paramètres totaux. Tous les modèles sont publiés sous licence Apache 2.0, offrant aux développeurs un accès ouvert aux capacités d'IA de pointe.
Mistral Large 3 est le premier modèle à mélange d'experts de Mistral depuis la série Mixtral, entraîné à partir de zéro sur 3 000 GPU NVIDIA H200. Il atteint la parité avec les meilleurs modèles à poids ouverts et à réglage d'instructions sur des requêtes générales, tout en démontrant une compréhension d'image et des performances de premier ordre dans les conversations multilingues.
La série Ministral 3 se décline en trois tailles (3B, 8B et 14B) avec des variantes de base, d'instruction et de raisonnement – chacune dotée de capacités multimodales et multilingues natives. Ces modèles offrent le meilleur rapport coût/performance de tous les modèles open-source de leur catégorie.
Chaque modèle Mistral 3 – du plus petit variant 3B au massif Large 3 – est publié sous licence Apache 2.0. Cela inclut à la fois les versions de base et celles affinées par instructions, offrant une base solide pour une personnalisation ultérieure au sein des communautés d'entreprise et de développeurs.
Mistral s'est associé à NVIDIA, vLLM et Red Hat pour offrir un support d'inférence efficace. Large 3 fonctionne sur un seul nœud 8×A100 ou 8×H100 utilisant vLLM, tandis que les modèles Ministral se déploient de manière transparente sur DGX Spark, les PC RTX, les ordinateurs portables et les appareils Jetson – du centre de données au robot.
"Mistral Large 3 rejoint les rangs des modèles open-source de pointe affinés par instructions, tandis que la série Ministral offre le meilleur rapport performance/coût de sa catégorie."
Cette double publication est remarquable car elle couvre tout le spectre du déploiement de l'IA – des modèles MoE massifs basés sur le cloud aux minuscules modèles denses optimisés pour la périphérie – le tout sous une seule licence permissive. Mistral Large 3 fait ses débuts à la 2e place dans la catégorie des modèles sans raisonnement OSS du classement LMArena, tandis que la série Ministral 3 établit une nouvelle norme pour une IA locale économique.
Vous avez besoin de modèles à poids ouverts qui équilibrent performance, coût et flexibilité de déploiement. Mistral 3 est idéal si vous construisez des applications multilingues, déployez l'IA sur des appareils en périphérie, ou souhaitez un modèle MoE de pointe que vous pouvez personnaliser librement. La licence Apache 2.0 et le large support matériel en font un choix solide pour les projets d'entreprise et communautaires.
D'autres outils que vous pourriez envisager
Okara vous permet d'utiliser plus de 30 modèles d'IA open-source puissants sans vous soucier de la configuration de l'infrastructure. Les meilleurs modèles comme Kimi et DeepSeek sont trop volumineux pour fonctionner sur votre ordinateur portable, nous nous en occupons pour vous. Basculez entre les modèles, recherchez sur Google, Reddit, X, YouTube dans vos conversations, analysez des fichiers, générez des images et travaillez en équipe. Tout est chiffré et nous n'utilisons jamais vos données pour l'entraînement.
TranslateGemma est une nouvelle suite de modèles de traduction IA ouverts, basée sur Gemma 3 de Google. Elle permet une communication de haute qualité dans 55 langues, alliant une grande précision à une efficacité exceptionnelle. Conçue pour fonctionner sur mobile, appareils locaux et environnements cloud sans compromettre les performances.
We introduce PersonaPlex, a full-duplex conversational AI model that enables natural conversations with customizable voices and roles. PersonaPlex handles interruptions and backchannels while maintaining any chosen persona, outperforming existing systems on conversational dynamics and task adherence.
Qu'est-ce que 1Code ? Une application pour exécuter vos agents Claude Code en parallèle, qui fonctionne sur Mac et sur le Web. Sur Mac — exécutez localement, avec ou sans worktrees. Sur le Web — exécutez dans des sandbox distants avec des aperçus en direct de votre application, y compris sur mobile, afin de pouvoir surveiller les agents depuis n'importe où. Exécuter plusieurs Claude Code en parallèle a considérablement accéléré notre façon de développer des fonctionnalités.
Créateur
moonbyte
Loading comments…