Das ARFF (Attribute-Relation File Format) ist ein Textdateiformat, das von der Machine Learning Group an der University of Waikato für die Beschreibung von Datensätzen im Bereich des maschinellen Lernens entwickelt wurde. Es wird primär mit der Software WEKA (Waikato Environment for Knowledge Analysis) verwendet, findet jedoch auch in anderen Werkzeugen für maschinelles Lernen Unterstützung. Eine ARFF-Datei besteht aus einem Header-Bereich und einem Datenbereich. Der Header-Bereich definiert den Relationsnamen (Datensatzname) sowie die Attribute (Merkmale oder Spalten) der Daten. Jedes Attribut wird mit seinem Namen und Datentyp (z. B. numerisch, nominal, String, Datum) deklariert. Der Datenbereich enthält die eigentlichen Dateninstanzen, wobei jede Instanz als eine durch Kommas getrennte Liste von Attributwerten dargestellt wird. Fehlende Werte werden üblicherweise durch ein Fragezeichen (?) repräsentiert. ARFF-Dateien sind so konzipiert, dass sie für Menschen lesbar und von Algorithmen des maschinellen Lernens leicht zu parsen sind, was sie zu einer beliebten Wahl für die Speicherung und den Austausch von Datensätzen in der Machine-Learning-Community macht. Das Format unterstützt verschiedene Datentypen und ermöglicht die Darstellung sowohl numerischer als auch kategorialer Daten, wodurch es vielseitig für eine breite Palette von Aufgaben im maschinellen Lernen einsetzbar ist.