Le Crible

Édition de 14 h

Le filThèmes : InfraModèlesOpen source

Liquid AI publie LFM2.5-⁠VL-⁠DSpark, un modèle brouillon expérimental pour accélérer son VLM LFM2.5-⁠VL-⁠3B

L’essentiel

Le décodage spéculatif accélère le décodage jusqu’à 3,13× sur l’appareil et 2,66× sur H100, sans changer la qualité des sorties. Le modèle brouillon ajoute 280 millions de paramètres, soit 8,9 % du modèle cible de 3 milliards.

Propagation1 article, publié par Blog Hugging Face le 24 sept. à 16 h 08.

Les sources

1 article

Sur les mêmes thèmes

  1. Open source

    OrcaRouter publie OrcaSAQ2 27B, Qwen3.8-⁠27B quantifié à 3 bits, qui est en tendance sur Hugging Face

    Pertinence 4,0 sur51 source

  2. Open source

    ISTA-⁠DASLab publie Qwen3.8-⁠Flash-Next-⁠GSQ-⁠RCO-⁠Coder-GGUF, une version compressée de Qwen3.8-⁠Flash-⁠Next

    Pertinence 4,0 sur51 source

  3. Open source

    ISTA-⁠DASLab publie des quantifications GGUF de Qwen3.8-⁠Flash-⁠Next en quatre tailles, de 66,4 à 83,6 Go

    Pertinence 4,0 sur51 source

  4. Open source

    OrcaRouter publie OrcaSAQ2 27B Cyber Uncensored, une version GGUF compressée de Qwen3.8-⁠27B sans censure

    Pertinence 3,8 sur51 source

À lire ensuite

  1. Modèles

    Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind

    Pertinence 5,0 sur54 sources

  2. Modèles

    OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna, deux modèles plus économiques qui complètent GPT-⁠6 Astra

    Pertinence 5,0 sur55 sources

  3. Modèles

    Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-⁠6 Sol et GPT-⁠6 Luna à environ une heure d’écart

    Pertinence 5,0 sur55 sources

  4. Modèles

    Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5

    Pertinence 4,9 sur52 sources