Le filThèmes : ÉvaluationsOutils dev
MicroLLM Lab permet de tester sept petits LLM directement dans le navigateur
1 sourcemis à jour 28 sept.pertinence 3,1 sur5
L’essentiel
La page mesure la vitesse en tokens par seconde et la précision sur des tests objectifs, à partir d’exécutions dans le navigateur. Les résultats restent sur la machine, et l’on peut écrire un benchmark en JavaScript.
Propagation1 article, publié par stateofutopia.com le 28 sept. à 20 h 58.
Les sources
1 article
stateofutopia.comCommunautéSource primaire
repéré sur Hacker News
MicroLLM Lab – Try 7 tiny LLM’s in the browser (site externe)
Sur les mêmes thèmes
Évaluations
LangChain intègre un routeur de modèles à son agent open source Open SWE et réduit le coût médian
Évaluations
WideSWE mesure la capacité des agents de code à coordonner des modifications entre dépôts
Évaluations
LangChain montre comment associer Jev, modèle de décision de TypeSafe AI, à LangGraph
Évaluations
Hugging Face ajoute un filtre pour les environnements d’apprentissage par renforcement sur le Hub
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5