Le filThèmes : Open sourceInfraModèles
OrcaRouter publie OrcaSAQ2 27B Cyber Uncensored, une version GGUF compressée de Qwen3.8-27B sans censure
1 sourcemis à jour il y a 5 jpertinence 3,8 sur5
L’essentiel
Le checkpoint passe de 54,7 à 15,7 Go avec +0,80 % de perplexité par rapport au BF16. Il tourne avec llama.cpp, Ollama et LM Studio ; selon OrcaRouter, jusqu’à 27,6 tokens/s avec DFlash2 sur un GPU de 24 Go.
Propagation1 article, publié par HF modèles en tendance le 2 oct. à 2 h 00.
Les sources
1 article
HF modèles en tendanceCommunauté : fiche de la sourceSource primaire
Hugging Faceorcarouterhuggingface.co
Modèle en tendance : orcarouter/OrcaSAQ-2-Cyber-27B-Uncensored-GGUF — génération de texte, 414 likes (site externe)
OrcaSAQ2 27B Cyber Uncensored GGUF compresses the uncensored Qwen3.8-27B from a 54.7 GB BF16 checkpoint to 15.7 GB while preserving extremely high fidelity to the original model.
Sur les mêmes thèmes
Open source
OrcaRouter publie OrcaSAQ2 27B, Qwen3.8-27B quantifié à 3 bits, qui est en tendance sur Hugging Face
Open source
ISTA-DASLab publie Qwen3.8-Flash-Next-GSQ-RCO-Coder-GGUF, une version compressée de Qwen3.8-Flash-Next
Open source
ISTA-DASLab publie des quantifications GGUF de Qwen3.8-Flash-Next en quatre tailles, de 66,4 à 83,6 Go
Infra
Liquid AI publie LFM2.5-VL-DSpark, un modèle brouillon expérimental pour accélérer son VLM LFM2.5-VL-3B
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5