Rechtsindex
Bewertet die Modellleistung im Rechtsbereich. Zu den bewerteten Fähigkeiten gehören Fachwissen (Vertragsrecht, Deliktsrecht, Verfassungsrecht), juristische Recherche und Textarbeit, Unterstützung bei Rechtsstreitigkeiten, Compliance-Prüfung und mehr.
Repräsentative Workflows ansehenThe Artificial Analysis Legal Index combines performance across benchmarks chosen for legal practice. We map common tasks from O*NET occupational classifications, then select benchmarks that represent this real-world work. Weights are derived from how often capabilities appear across those tasks.
This composite metric provides a single score for tracking model performance across legal tasks. Alle zugrunde liegenden Benchmarks werden unabhängig von Artificial Analysis durchgeführt. Wie die Evaluierungen ablaufen, erläutert unsere Methodik für das Intelligenz-Benchmarking.
| Fähigkeit | Gewichtung | Evaluierungen |
|---|---|---|
| Rechtswissen | 35 % | AA-Omniscience: Genauigkeit in Recht |
| Agentische Wissensarbeit | 25 % | GDPval-AA v2.1 und AA-Briefcase v1.1 |
| Schlussfolgern | 15 % | HLE |
| Langer Kontext | 10 % | LCR und GDP.pdf |
| Halluzinationsvermeidung | 10 % | AA-Omniscience: Halluzinationsvermeidung in Recht |
| Agentische Werkzeugnutzung | 5 % | AutomationBench-AA Support und Betrieb |
Punktzahl
Artificial Analysis Rechtsindex
Artificial Analysis Rechtsindex: Aufschlüsselung der Fähigkeiten
Aufschlüsselung der Fähigkeiten
Artificial Analysis Rechtsindex: Rechtswissen
Repräsentative Workflows
Praxisnahe Workflows, die besonders die von Rechtsindex am stärksten gewichteten Fähigkeiten prüfen.
Beispiel: Determine whether a non-compete is enforceable under controlling state precedent by gathering the relevant case law, applying each holding to the employee's facts, distinguishing unfavorable rulings, and synthesizing the analysis into a report.
Beispiel: Reconcile US and EU indemnity language in a cross-border M&A share purchase agreement 48 hours before signing to flag irreconcilable conflicts, propose drafting that satisfies both regimes where possible, and deliver a partner-ready redline.
Beispiel: Advise a startup shipping a feature that may trigger unsettled state privacy rules such as the CCPA to ask the clarifying questions, lay out the trade-offs by jurisdiction, surface open legal risks, and recommend a defensible launch posture.
Beispiel: Work a 200,000-document e-discovery production delivered ten days before trial to prioritise responsive material, flag likely privilege issues for attorney review, and draft a deposition outline tied to the strongest exhibits.
Beispiel: Rewrite internal policy for a new financial regulation taking effect in 90 days that clashes with procedures in three business units to produce a unified replacement policy, an implementation plan with named owners, and a training brief grounded in the statute and existing policy library.
Beispiel: Consolidate 40 active litigation matters tracked across three incompatible case-management systems to produce one unified docket, surface conflicting court deadlines, and propose a single workflow going forward.
Kosten
Artificial Analysis Rechtsindex: Kosten pro Aufgabe
Artificial Analysis Rechtsindex vs. Kosten pro Aufgabe
Geschwindigkeit
Artificial Analysis Rechtsindex: Zeit pro Aufgabe
Ausgabe-Token
Artificial Analysis Rechtsindex: Ausgabe-Token pro Aufgabe
Veröffentlichungsdatum
Artificial Analysis Rechtsindex vs. Veröffentlichungsdatum
Häufig gestellte Fragen
Laut dem Artificial Analysis Rechtsindex sind Claude Opus 5.5 (Max, Default Fallback) (63), Claude Fable 5.1 (Xhigh, Default Fallback) (61) und Claude Opus 5.5 (Xhigh, Default Fallback) (61) derzeit die leistungsstärksten KI-Modelle für juristische Aufgaben. Die Rangliste wird bei der Veröffentlichung neuer Modelle aktualisiert.
Ja. Der Rechtsindex von Artificial Analysis ist ein unabhängiger Benchmark für die Leistung von KI-Modellen bei juristischen Aufgaben. Er misst Rechtswissen, agentische Wissensarbeit, Schlussfolgern, die Analyse langer Dokumente, Halluzinationsfreiheit und agentische Tool-Nutzung.
Der Rechtsindex ist ein zusammengesetzter Benchmark von Artificial Analysis, der die Modellleistung im Rechtsbereich bewertet. Geprüft werden unter anderem Fachwissen zu Vertragsrecht, Deliktsrecht und Verfassungsrecht, Rechtsrecherche und -redaktion, Unterstützung bei Rechtsstreitigkeiten sowie Compliance-Prüfung.
Der Rechtsindex wird als gewichteter Durchschnitt seiner Teilpunktzahlen berechnet. Die Teilpunktzahlen und ihre Gewichtungen sind: Rechtswissen (35 %), Agentische Wissensarbeit (25 %), Schlussfolgern (15 %), Langer Kontext (10 %), Halluzinationsvermeidung (10 %) und Agentische Werkzeugnutzung (5 %).
Der Rechtsindex enthält AA-Omniscience: Genauigkeit in Recht, GDPval-AA v2.1, AA-Briefcase v1.1, HLE, LCR, GDP.pdf, AA-Omniscience: Halluzinationsvermeidung in Recht und AutomationBench-AA Support und Betrieb.
Claude Opus 5.5 (Max, Default Fallback) erzielt derzeit mit 63 die höchste Punktzahl im Rechtsindex unter den Modellen mit veröffentlichten Ergebnissen. Modell ansehen
Eine höhere Punktzahl im Rechtsindex steht für eine insgesamt stärkere Leistung in den Benchmarks des Index. Für einen bestimmten Anwendungsfall können einzelne Benchmark-Ergebnisse aussagekräftiger sein als die zusammengesetzte Punktzahl.