Mistral AI présente Mistral Large 4, disponible en préversion via son API
Selon Simon Willison, le modèle compte 1 000 milliards de paramètres, dont 49 milliards actifs.
Édition de 14 h
Ajout manuel
Un lien qui a échappé aux flux ? Collez-le ici : il rejoint la veille, noté et résumé en français comme le reste.
Aucun lien ajouté à la main sur 14 jours
Les liens collés ici ou envoyés par le favori apparaîtront dans cette liste.
Glissez ce bouton dans la barre de favoris : sur n’importe quel article, un clic l’envoie ici, adresse et titre remplis.
Sur mobile, les favoris ne se glissent pas : partagez ou copiez le lien de l’article, puis collez-le dans le formulaire.
Enregistré aussitôt. Un doublon est signalé, jamais recréé.
Lu dans l’heure. Titre, note sur 5 et résumé en français. Si le site n’est pas sur la liste des sources dont les conditions permettent la lecture (presse, Substack, GitHub…) : titre et lien seulement, page non lue.
Rangé dans sa story. Avec les autres sources du sujet.
Un sujet déjà suivi ? Le nouvel article rejoindra sa story, avec ses autres sources.
Tout le FilSelon Simon Willison, le modèle compte 1 000 milliards de paramètres, dont 49 milliards actifs.
Selon lui, un modèle d’embeddings propriétaire expose à devoir recalculer des millions de vecteurs si le fournisseur l’abandonne.
Selon Reflection, Beam rivalise avec les principaux modèles chinois et demande nettement moins de calcul.
Selon la lettre Latent Space, ils proviennent d’une évaluation d’environ 4 000 problèmes de recherche et ont mobilisé en moyenne environ trois heures de calcul de ChatGPT Pro par résultat.
Dans son Cyber Verification Program, Anthropic ajoute des niveaux dédiés aux travaux offensifs autorisés, comme les tests d’intrusion et le red-teaming.
Le modèle compte 560 milliards de paramètres au total, dont 25 milliards sont actifs.
HAD complète la distillation on-policy par une préférence d’action, comparée avec et sans les informations du harness, et par un contrôle de validité.
Le modèle est facturé 0,02 dollar par million de tokens en entrée.
43 sources suivies : leurs articles arrivent seuls, inutile de les coller ici.
La pipeline en coulissesHF Daily Papers
385 articles en 7 jours
AINews
111 articles en 7 jours
Hacker News
63 articles en 7 jours
TLDR AI
58 articles en 7 jours
TLDR IT
54 articles en 7 jours
TLDR Data
29 articles en 7 jours
Simon Willison
22 articles en 7 jours
HF modèles en tendance
18 articles en 7 jours
OpenAI
14 articles en 7 jours
Vercel (IA)
12 articles en 7 jours
404 Media (IA)
11 articles en 7 jours
claude.dev
8 articles en 7 jours
Latent Space
8 articles en 7 jours
Blog Hugging Face
7 articles en 7 jours
Blog Modal
5 articles en 7 jours
Google DeepMind
3 articles en 7 jours
Google Research
3 articles en 7 jours
Blog Langfuse
2 articles en 7 jours
Blog Together AI
2 articles en 7 jours
Latent.Space
2 articles en 7 jours
Matt Shumer | Something Big is Happening
2 articles en 7 jours
Mistral AI
2 articles en 7 jours
Anthropic
1 article en 7 jours
Blog ClickHouse (IA)
1 article en 7 jours
Blog LangChain
1 article en 7 jours
Claude Code (releases)
1 article en 7 jours
Cursor (notes de version)
1 article en 7 jours
Google AI (blog)
1 article en 7 jours
Import AI
1 article en 7 jours
Interconnects
1 article en 7 jours
One Useful Thing
1 article en 7 jours
Ahead of AI
0 article en 7 jours
Ai2 (Allen Institute for AI)
0 article en 7 jours
Anthropic Engineering
0 article en 7 jours
Blog NVIDIA
0 article en 7 jours
Epoch AI (Gradient Updates)
0 article en 7 jours
HF DeepSeek (modèles)
0 article en 7 jours
HF Qwen (modèles)
0 article en 7 jours
Meta Newsroom (IA)
0 article en 7 jours
Platformer
0 article en 7 jours
SemiAnalysis
0 article en 7 jours
TLDR
0 article en 7 jours
Understanding AI
0 article en 7 jours