Fine-tuning search agents with multi-turn reinforcement learning on SageMaker
Amazon demonstrates how multi-turn RL fine-tunes a Qwen3.6-27B search agent, cutting failure rates from 22% to under 1% while improving retrieval quality.
Tägliche Berichterstattung zu KI, Entwicklertools und Infrastruktur. Jeder Artikel erklärt, was passiert ist und warum es wichtig ist, inklusive Link zur Originalquelle.
Amazon demonstrates how multi-turn RL fine-tunes a Qwen3.6-27B search agent, cutting failure rates from 22% to under 1% while improving retrieval quality.
Graph RAG ergänzt die Vektorsuche um explizite Beziehungsnachweise und hilft Agenten, Multi-Hop-Fragen zu Abhängigkeiten und Richtlinien zu beantworten, ohne Verbindungen zu halluzinieren.
Cloudflares KI-Suche ist jetzt allgemein verfügbar und bietet native Bild-Einbettungen, OCR für PDFs sowie Unterstützung für größere Dateien. Die Abrechnung beginnt am 1. November 2026.
Cohere hat Embed 5 veröffentlicht. Es ermöglicht Entwicklern, mit einem hochwertigen Pro-Modell zu indexieren und im selben Vektorraum mit einem schnelleren Fast-Modell abzufragen.
OpenAI hat Dots vorgestellt, persistente KI-Agenten, die auf dem Modell GPT-6 Astra basieren, auf dedizierten Cloud-Computern laufen und kontinuierlich über Tausende von Apps hinweg arbeiten.
Condé Nast hat die Zeit für die Videosuche von 250 Minuten auf unter zwei Minuten verkürzt, indem Amazon Bedrock und TwelveLabs Marengo für die semantische Suche über 140.000 Clips hinweg eingesetzt wurden.
Unabhängige Benchmarks zeigen, dass Ember-1 von Fireworks Research die Genauigkeit von Kimi K3 erreicht, dabei weniger Reasoning-Tokens verwendet und 3,4-mal schneller läuft.