Fine-tuning search agents with multi-turn reinforcement learning on SageMaker
Amazon demonstrates how multi-turn RL fine-tunes a Qwen3.6-27B search agent, cutting failure rates from 22% to under 1% while improving retrieval quality.
Couverture quotidienne de l’IA, des outils pour développeurs et de l’infrastructure. Chaque article explique ce qui s’est passé et pourquoi c’est important, avec un lien vers la source originale.
Amazon demonstrates how multi-turn RL fine-tunes a Qwen3.6-27B search agent, cutting failure rates from 22% to under 1% while improving retrieval quality.
Le Graph RAG ajoute des preuves explicites de relations à la recherche vectorielle, aidant les agents à répondre à des questions multi-sauts sur les dépendances et les politiques sans halluciner de connexions.
La recherche IA de Cloudflare est désormais disponible en version générale, ajoutant des embeddings d'images natifs, l'OCR pour les PDF et la prise en charge de fichiers plus volumineux. La facturation débutera le 1er novembre 2026.
Cohere a lancé Embed 5, permettant aux développeurs d'indexer avec un modèle Pro de haute qualité et d'effectuer des requêtes avec un modèle Fast plus rapide dans le même espace vectoriel.
OpenAI a présenté Dots, des agents IA persistants propulsés par GPT-6 Astra qui s'exécutent sur des ordinateurs cloud dédiés et fonctionnent en continu à travers des milliers d'applications.
Condé Nast a réduit le temps de découverte de vidéos de 250 minutes à moins de deux minutes en utilisant Amazon Bedrock et TwelveLabs Marengo pour une recherche sémantique sur 140 000 extraits.
Des benchmarks indépendants montrent que Ember-1 de Fireworks Research égale la précision de Kimi K3 tout en utilisant moins de jetons de raisonnement et en fonctionnant 3,4 fois plus vite.