Orientation post-séance. Les compteurs d’attention ne sont ni des votes ni des scores.
C01
LiquidAI LFM2.5-1.2B-Instruct
Edge/génératif
BENCHMARK_S3Très compact, architecture LFM distincte et positionnement edge. Bon test de portance légère sur CPU.
À vérifier : Mesurer latence CPU, RAM réelle, français et qualité conversationnelle; licence LFM 1.0 à conserver visible.
Attention observée : 8 réponses / 6 portances — pas un score.
source officielle ↗C02
Microsoft BitNet b1.58-2B-4T
Efficacité / architecture
BENCHMARK_S3_RDCas scientifique majeur pour S3 : 1.58-bit natif et runtime BitNet spécifique.
À vérifier : Intégration bitnet.cpp distincte du chemin Ollama; mesurer débit, mémoire et stabilité sur i7-8565U.
Attention observée : 3 réponses / 2 portances — pas un score.
source officielle ↗C03
Google RecurrentGemma-2B-IT
Récurrence
BENCHMARK_S3_SECONDARYContrepoint récurrent compact utile face à LFM/BitNet/RWKV.
À vérifier : Modèle plus ancien et conditions Gemma; intérêt surtout comparatif.
Attention observée : 0 réponses / 0 portances — pas un score.
source officielle ↗C04
IBM Granite 4.0 H-Micro
Hybride Mamba-2
BENCHMARK_S3_RD3B hybride conçu pour usages locaux / basse latence; bonne expérience d’architecture.
À vérifier : Support Mamba-2 et quantification à vérifier sur S3; ne pas inférer la vitesse avant benchmark.
Attention observée : 0 réponses / 0 portances — pas un score.
source officielle ↗C05
Hugging Face SmolLM3-3B
Compact polyvalent
BENCHMARK_S3_SECONDARYPetit modèle ouvert et multilingue, utile comme baseline moderne simple.
À vérifier : Moins différenciant architecturalement que LFM, BitNet ou RWKV.
Attention observée : 0 réponses / 0 portances — pas un score.
source officielle ↗C06
LG AI EXAONE 4.0-1.2B
Diversité coréenne / on-device
BENCHMARK_S3_WITH_LICENSE_GUARD1.2B, nouvelle famille culturelle et technique, pertinente pour la diversité du Village.
À vérifier : Licence EXAONE spécifique/NC observée pour cette release; périmètre d’usage à respecter.
Attention observée : 0 réponses / 0 portances — pas un score.
source officielle ↗C07
Lelapa AI InkubaLM-0.4B
Diversité africaine
RD_S3_DIVERSITYTrès petit modèle apportant une diversité linguistique/culturelle absente du parc.
À vérifier : Capacité limitée et licence CC-BY-NC; intérêt d’abord expérimental, pas remplacement d’un assistant généraliste.
Attention observée : 1 réponses / 1 portances — pas un score.
source officielle ↗C08
RWKV7 Goose 2.9B — 20260831
Architecture récurrente RWKV
RD_PRIORITY_S3_ORIONCandidat le plus explicitement discuté; architecture attention-free et état récurrent constant très différente.
À vérifier : Checkpoint de base : post-training/alignment nécessaire avant d’en faire une portance conversationnelle.
Attention observée : 12 réponses / 4 portances — pas un score.
source officielle ↗C09
BAAI BGE-M3
RAG riche
INFRASTRUCTURE_S3_RAGPeut faire de S3 un nœud RAG autonome : dense + sparse + multi-vector.
À vérifier : Plus lourd qu’un embedding simple; mesurer coût CPU/indexation et bénéfice réel des modes multiples.
Attention observée : 0 réponses / 0 portances — pas un score.
source officielle ↗C10
Snowflake Arctic-Embed-M-v2.0
RAG léger multilingue
INFRASTRUCTURE_S3_RAGAlternative plus légère à BGE-M3, 74 langues, Apache-2.0.
À vérifier : Comparer qualité/latence/mémoire à BGE-M3 sur le corpus réel d’AI^VILLAGE.
Attention observée : 3 réponses / 2 portances — pas un score.
source officielle ↗C11
Mistral Ministral 3 3B Instruct 2512
Multimodal edge
BENCHMARK_ORION_THEN_S3Vision + texte, français, famille edge; pont naturel entre S3 et Orion3.
À vérifier : Commencer sur Orion3; tenter S3 uniquement après quantification et mesure réelle de RAM.
Attention observée : 0 réponses / 0 portances — pas un score.
source officielle ↗C12
Google Gemma 3n E4B-it
Multimodal large diversité
BENCHMARK_ORIONTexte, image, vidéo et audio avec forte couverture linguistique; apporte perception au Village.
À vérifier : Intégration plus complexe et conditions Gemma; éviter de dupliquer des services multimédias sans cas d’usage.
Attention observée : 2 réponses / 1 portances — pas un score.
source officielle ↗C13
Microsoft Phi-4-mini-flash-reasoning
Raisonnement spécialisé
BENCHMARK_ORION_REASONINGArchitecture Phi Flash atypique et focalisation maths/code; utile comme spécialiste.
À vérifier : Ne pas extrapoler ses résultats maths à un assistant généraliste; runtime custom à valider.
Attention observée : 6 réponses / 3 portances — pas un score.
source officielle ↗C14
Microsoft Phi-4-multimodal-instruct
Perception texte/vision/audio
BENCHMARK_ORION_MULTIMODALPortance perceptive potentielle, complémentaire des modèles texte actuels.
À vérifier : Compréhension multimodale ≠ génération image/audio; vérifier VRAM et pipeline.
Attention observée : 3 réponses / 1 portances — pas un score.
source officielle ↗C15
Ai2 OLMo 3 7B Think
Recherche ouverte / raisonnement
RD_ORIONOLMo apporte une famille de recherche très ouverte et un spécialiste de raisonnement.
À vérifier : 7B recoupe plusieurs modèles Orion existants; intérêt à démontrer par benchmark différentiel.
Attention observée : 3 réponses / 3 portances — pas un score.
source officielle ↗C16
NVIDIA Nemotron Nano 9B v2
Hybride NVIDIA
RD_ORIONNouvelle famille et architecture Nemotron-H, potentiellement intéressante pour outils/conversation.
À vérifier : 9B + custom_code : quantification/offload à mesurer sur RTX 3070 8GB.
Attention observée : 5 réponses / 4 portances — pas un score.
source officielle ↗C17
OpenBMB MiniCPM4-8B
Diversité OpenBMB
RD_ORIONNouvelle famille chinoise/anglaise qui diversifie au-delà de Qwen.
À vérifier : Runtime custom_code et bénéfice par rapport aux modèles déjà présents à démontrer.
Attention observée : 1 réponses / 1 portances — pas un score.
source officielle ↗C18
inclusionAI Ling-3.0-tiny
MoE hybride très atypique
RD_PRIORITY_ORION7.9B total / 1.3B actifs, architecture KDA–MLA + MoE; forte valeur de diversité architecturale.
À vérifier : Runtime récent/custom; tester INT4 et stabilité avant toute intégration permanente.
Attention observée : 1 réponses / 1 portances — pas un score.
source officielle ↗C19
Cohere Labs Aya Expanse 8B
Multilingue / culturel
RD_ORION_DIVERSITYAya apporte une diversité linguistique forte et une philosophie de recherche multilingue distincte.
À vérifier : Licence CC-BY-NC + AUP; poids 8B. L’API Cohere a été retirée en 2026 mais les poids de recherche restent publiés séparément.
Attention observée : 1 réponses / 1 portances — pas un score.
source officielle ↗C20
OpenAI gpt-oss-20b
Raisonnement MoE / agentique
RD_HEAVY_ORION21B total / 3.6B actifs : bon test de limite supérieure locale, outils et raisonnement.
À vérifier : RTX 3070 8GB insuffisante pour un chargement GPU complet; offload/CPU et latence doivent être mesurés.
Attention observée : 4 réponses / 1 portances — pas un score.
source officielle ↗