Muster werden geladen…
Tool Retrieval (Tool RAG)(TR)
Wenn ein Agent auf Hunderte oder Tausende von Tools oder MCP-Servern zugreifen kann, ist es teuer, jedes Schema in den Prompt zu laden, und es beeinträchtigt die Auswahlgenauigkeit. Tool Retrieval indiziert die Tool-Definitionen und ruft für jede Anfrage nur die semantisch relevanten ab (Embedding-Suche, aktive Discovery und Reranking), bevor das Modell auswählt. RAG-MCP berichtet, dass die Genauigkeit der Tool-Auswahl von etwa 13 Prozent auf 43 Prozent steigt, während die Prompt-Tokens um mehr als die Hälfte reduziert werden.
In 30 Sekunden
- Was
- Indexiert Werkzeugdefinitionen als Embeddings, holt pro Anfrage nur semantisch relevante Schemata und ordnet sie neu, bevor das Modell auswählt.
- Wann einsetzen
- Agenten greifen auf Hunderte oder Tausende Werkzeuge zu, und das Laden aller Schemata verschwendet Tokens und verschlechtert die Auswahlgenauigkeit.
- Achtung
- Fehlschläge beim Retrieval, etwa durch schlechte Embedding-Treffer oder falsches Ranking, lassen das richtige Werkzeug still unter den Tisch fallen, sodass der Agent eine schlechtere Alternative wählt.
Fragen Sie den KI-Experten zu diesem Pattern
Öffnet den Assistenten mit vorbereiteter Frage. Sie prüfen sie vor dem Senden.
Tool Retrieval (Tool RAG): Überblick
Wenn ein Agent auf Hunderte oder Tausende von Tools oder MCP-Servern zugreifen kann, ist es teuer, jedes Schema in den Prompt zu laden, und es beeinträchtigt die Auswahlgenauigkeit. Tool Retrieval indiziert die Tool-Definitionen und ruft für jede Anfrage nur die semantisch relevanten ab (Embedding-Suche, aktive Discovery und Reranking), bevor das Modell auswählt. RAG-MCP berichtet, dass die Genauigkeit der Tool-Auswahl von etwa 13 Prozent auf 43 Prozent steigt, während die Prompt-Tokens um mehr als die Hälfte reduziert werden.
- Vector index over tool and MCP server definitions
- Per-query semantic retrieval of relevant tools only
- Reranking to shortlist the top-k candidate tools
- Active, on-demand discovery instead of preloading all schemas
- Large prompt-token reduction versus loading every schema
- Higher tool-selection accuracy at scale (thousands of tools)
The Agent Architect
Ein Pattern, ein Tradeoff, eine Produktionspanne. Ein kurzes wöchentliches Briefing für alle, die agentische Systeme bauen.
Wöchentliche E-Mail, Abmeldung mit einem Klick. Ihre Adresse wird nur für das Briefing verwendet.
Quellen
Die Veröffentlichungen, Spezifikationen und Repositories, auf denen dieses Muster beruht.
Vom Ingenieur hinter diesem Katalog
Lassen Sie Ihre Agenten-Architektur prüfen
Diese Seite dokumentiert ein Pattern. Ihr System betreibt Dutzende, und die meisten Ausfälle entstehen im Zusammenspiel. Lassen Sie den gesamten Entwurf an den 288 Patterns dieses Katalogs messen: Architektur, Zuverlässigkeit, Evaluation und Kosten, jeder Befund verknüpft mit dem Pattern, das ihn behebt.
750 € statt 1.500 €, eine Woche, schriftlicher Bericht und Walkthrough-Call, bis 30. September