
Mit dem „Expenditure Horizon“ will METR messbar machen, wie kosteneffektiv KI-Agenten Probleme lösen. Erste Ergebnisse am NanoGPT-Speedrun fallen nüchtern aus, doch die Kennzahl hat blinde Flecken, und die neueste Modellgeneration könnte den Trend brechen.
Der Artikel METRs „Expenditure Horizon“ berechnet, ab wann menschliche Entwickler wirtschaftlicher sind als KI erschien zuerst auf The Decoder.