Le filThèmes : AgentsÉvaluations
OpenAI a construit un agent de données interne qui répond à des questions complexes sur ses données
1 sourcemis à jour il y a 2 jpertinence 3,0 sur5
L’essentiel
Selon OpenAI, l’agent affiche ses hypothèses, son SQL, ses citations et sa confiance. La leçon : la fiabilité dépend moins de l’intelligence brute du modèle que du contexte fourni et des évaluations.
Propagation1 article, publié par TLDR Data le 5 oct. à 12 h 13.
Les sources
1 article
Aucune source primaire : la page de l’auteur du fait n’est pas parmi les sources.
TLDR DataRelais
youtube.com
Diving Through Data at OpenAI: How a Data Agent Navigates 70,000 Datasets (27 minute video) (site externe)
OpenAI built an internal AI data agent that answers complex data questions by combining warehouse queries with rich context from schemas, lineage, code, company knowledge, memory, and live sources, while showing its assumptions, SQL, citations, and confidence.
Sur les mêmes thèmes
Agents
LangChain intègre un routeur de modèles à son agent open source Open SWE et réduit le coût médian
Évaluations
Microsoft publie ThinkingBox, un benchmark qui note les agents sur l’état final de la base de données
Agents
SkillSeek montre que BM25 rivalise avec la recherche agentique de skills pour les agents
Agents
Weave publie en open source Weave Router 2.0, qui oriente les agents de code vers différents modèles
À lire ensuite
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5