LLM inference speeds measured on Apple Silicon, raw data released

A benchmark study reports LLM inference speeds on Apple Silicon chips. The measurements cover various model sizes

A benchmark study reports LLM inference speeds on Apple Silicon chips. The measurements cover various model sizes and configurations. Raw performance data is made publicly available. The dataset is released under a Creative Commons BY 4.0 license. Results compare inference latency across different hardware settings. The study aims to inform developers about Apple Silicon capabilities. The findings are hosted at the provided URL. Users can download the data for further analysis.