Methodik des Openness Index

Überblick

Der Artificial Analysis Openness Index ist eine zusammengesetzte Metrik, die misst, in welchem Umfang KI-Modelle offen verfügbar und transparent dokumentiert sind. Er berücksichtigt sowohl die Verfügbarkeit der Modellgewichte als auch die Transparenz der zugrunde liegenden Daten und der Methodik, mit denen das Modell erstellt wurde.

Jedes Modell wird anhand aller öffentlich verfügbaren Erstanbieterinformationen bewertet. Modelle, die auf einem Basismodell eines Drittanbieters aufbauen, können durch dessen Lizenzierung oder begrenzte Offenlegung eingeschränkt sein. Bei inkrementellen oder aktualisierten Veröffentlichungen werden nur Angaben berücksichtigt, die sich ausdrücklich auf die neue Version beziehen. Dazu zählt auch die Erklärung des Modellentwicklers, welche Komponenten gegenüber einer früheren Version unverändert geblieben sind.

Eine ausführliche Spezifikation der Methodik steht als PDF zum Download bereit.

Zusammensetzung des Index

1. Modellverfügbarkeit
Gewichte
Zugang
0Geschlossene Gewichte, keine API
1Geschlossene Gewichte, API schränkt Token-Sichtbarkeit ein
2Geschlossene Gewichte, API verfügbar
3Offene Gewichte
Lizenz
0Geschlossene Gewichte oder keine kommerzielle Nutzung
1Kommerzielle Nutzung, Namensnennung erforderlich
2Kommerzielle Nutzung, keine Namensnennung erforderlich
3Kommerzielle Nutzung, keine Namensnennung erforderlich, keine wesentlichen Einschränkungen
2. Modelltransparenz
Daten:Pre- und Post-Training(Punktzahl entspricht dem jeweiligen Durchschnitt)
Zugang
0Keine oder begrenzte Offenlegung
1Datenquellen und Kategorisierung teilweise offengelegt
2Zusammensetzung der Daten vollständig offengelegt, umfangreiche Daten freigegeben¹
3Alle Daten freigegeben
Lizenz (restriktivste)
0Keine kommerzielle Nutzung/keine umfangreichen Daten freigegeben
1Kommerzielle Nutzung, Namensnennung erforderlich
2Kommerzielle Nutzung, keine Namensnennung erforderlich
3Kommerzielle Nutzung, keine Namensnennung erforderlich, keine wesentlichen Einschränkungen
Methodik
Offenlegung
0Keine oder begrenzte Offenlegung
1Modellarchitektur offengelegt
2Begrenzte allgemeine technische Offenlegung
3Vollständige technische Details offengelegt
Lizenz (restriktivste)
0Kein Code offengelegt/veröffentlicht
1Frameworks offengelegt und frei für kommerzielle Nutzung verfügbar
2Code oder Leitfaden für die End-to-End-Trainingspipeline veröffentlicht
3Code oder Leitfaden für die End-to-End-Trainingspipeline veröffentlicht und kommerzielle Nutzung erlaubt

Jede Komponente wird anhand des am besten passenden Offenheitsarchetyps auf einer qualitativen Skala von 0 bis 3 bewertet. Für jedes Modell werden dabei alle öffentlich verfügbaren Erstanbieterinformationen berücksichtigt.

Modelle, die auf einem Basismodell eines Drittanbieters aufbauen, können durch dessen Lizenzierung oder begrenzte Offenlegung eingeschränkt sein. Bei inkrementellen oder aktualisierten Veröffentlichungen berücksichtigen wir nur Angaben, die sich ausdrücklich auf die neue Version beziehen. Dazu zählt auch die Erklärung des Modellentwicklers, welche Komponenten gegenüber einer früheren Version unverändert geblieben sind.

Berechnung der Punktzahl

Die endgültige Punktzahl des Openness Index wird wie folgt berechnet:

  • Datenkomponenten werden für Pre- und Post-Training getrennt bewertet und anschließend zu einer gemeinsamen Datenpunktzahl gemittelt (bis zu 6 mögliche Punkte für Zugang und Lizenz zusammen).
  • Alle Komponentenpunktzahlen werden addiert; die maximale Rohpunktzahl beträgt 18.
  • Die Rohpunktzahl wird auf eine Skala von 0 bis 100 normalisiert: