In den Nachrichten
Cited but Not Consulted: A Counterfactual Audit of Legal Chain-of-Thought Faithfulness
arXiv cs.AI · Veröffentlicht am · 3 Min. Lesezeit
In 30 Sekunden
- Was passiert ist
- Researchers found that legal AI models cite correct statutes but don't actually use them to reach verdicts, showing poor faithfulness in legal reasoning.
- Warum es zählt
- Matters for engineers building legal AI systems and organizations relying on model explanations for compliance, audit, or decision justification.
- Achtung
- The gap persists across model sizes and specialized legal models, and verdicts remain vulnerable to adversarial manipulation hidden in case facts.
Den vollständigen Artikel lesen
- language model
- reasoning
- benchmark
- open-weight
Die Patterns dahinter
Jedes zeigt, wie die Technik arbeitet, wann sie ihren Aufwand wert ist und wo sie scheitert.
The Agent Architect
Ein Pattern, ein Tradeoff, eine Produktionspanne. Ein kurzes wöchentliches Briefing für alle, die agentische Systeme bauen.
Wöchentliche E-Mail, Abmeldung mit einem Klick. Ihre Adresse wird nur für das Briefing verwendet.