llm
Das günstigste LLM Modell, das nur Text können muss
Die Modellwahl ist selten ein Wissensproblem. Sie ist ein Filterproblem, und solange der Filter fehlt, verteilt sich die Antwort auf fünf Browser-Tabs, die sich gegenseitig widersprechen.
Nenn mir das günstigste Modell, das nur Text produzieren muss. Nicht das beste, nicht das, über das diese Woche alle schreiben, einfach das günstigste, das einen Absatz schreiben kann und mit Bildern nichts zu tun haben muss. Wahrscheinlich kannst du das nicht, jedenfalls nicht ohne zwanzig Minuten zwischen fünf Anbieterseiten hin und her, jede mit eigenem Tabellenlayout, eigenen Fussnoten und einer eigenen Vorstellung davon, was ein Preis überhaupt ist.
Ich habe das oft genug gemacht, um zu merken, dass ich es mache, und das ist üblicherweise der Moment, in dem ich aufhöre und stattdessen etwas baue. Mit ein paar Agenten für das Abholen und die stumpfen Teile hat das Tool weniger Zeit gekostet als die Recherche, die es ersetzt, was sowohl über das Tool als auch über die Recherche etwas aussagt.
Was drin steht
443 Preiszeilen, 402 verschiedene Modelle, fünf Anbieter: OpenAI, Anthropic, die Google Gemini API, Hugging Face Inference Providers und Moonshot AI (Kimi). Der Stand, den ich gerade vor mir habe, wurde am 3. August 2026 um 13:45 UTC erzeugt, und dieser Zeitstempel steht sichtbar auf der Seite, weil eine Preisliste ohne Datum ein Gerücht ist.
Alles in USD pro einer Million Token, ausser eine Zeile verwendet eine andere Einheit, dann sagt die Zeile das auch. Jede Zeile führt Anbieter, Modellname, Modell-ID, Modalität, Preisstufe, Input- und Output-Preis, den Cache-Read-Preis, sofern der Anbieter einen veröffentlicht, das Context Window, die Original-Quell-URL, das Abrufdatum und eine Confidence-Angabe.
Der Teil, der wirklich Zeit spart
Zurück zur Eingangsfrage. Preset "cheapest input", Modalität auf Text filtern, Zeilen ohne Token-Preis ausblenden, und aus 402 Modellen wird eine kurze Liste, die man in einem Durchgang liest. Mehr ist der Trick nicht. Das ist nicht raffiniert, das ist schlicht Arbeit, die einmal jemand machen musste, damit sie niemand mehr an einem Dienstagnachmittag wiederholt.
Dazu: Suche nach Anbieter oder Modell, Filter über eine Input-Preisspanne, Anbieter und Modalität kombiniert, oder gleich die Presets für günstigsten Input, günstigsten Output, reine Textmodelle und Gruppierung nach Anbieter. Jede Spalte lässt sich sortieren. Wer den Rest lieber in einer Tabellenkalkulation erledigt, nimmt den CSV-Export.
Zwei Spalten, weil die rohen Zahlen ein wenig lügen
Die erste ist ein optionaler Mischpreis: drei Teile Input plus ein Teil Output, geteilt durch vier. Ein Modell mit freundlichem Input-Preis und brutalem Output-Preis sieht in einer nach Input sortierten Tabelle hervorragend aus, bis die Rechnung kommt, und die 3:1-Gewichtung ist eine grobe Näherung für Traffic, bei dem man mehr hinschickt als zurückbekommt.
Die zweite ist ein Monatskostenrechner: Input-Token pro Request, Output-Token pro Request, Requests pro Monat. "USD pro Million Token" ist keine Einheit, für die irgendjemand ein Gefühl hat. Ein Monatsbetrag schon, und der beendet Diskussionen deutlich schneller.
Was die Liste bewusst nicht tut
Die Basis ist Pay-as-you-go, Standard-Tier. Keine Mengenrabatte. Batch-Rabatte werden separat gehalten und nicht in den angezeigten Preis eingerechnet, denn eine still verrechnete Ermässigung in der Hauptspalte würde genau den Anbieter begünstigen, der zufällig Batching anbietet, und das wäre kein Vergleich mehr, sondern Werbung.
Jede Zeile trägt eine Confidence-Angabe, und alles mit mittlerer oder unbekannter Confidence kommt mit einer Notiz, warum das so ist. Jede Zeile verlinkt ausserdem ihre Originalquelle samt Abrufdatum. Preise ändern sich oft genug, dass man vor einer Budgetentscheidung in die Quelle schauen sollte ... die Liste bringt dich zu den richtigen drei Kandidaten, nicht zu einem unterschriebenen Vertrag.
Ungefähr das ist der Handel, den ich anbieten kann. Keine Sicherheit, nur eine deutlich kürzere Liste, erreicht in etwa fünfzehn Sekunden statt zwanzig Minuten.
Die Liste steht hier und wird regelmässig neu erzeugt:
- Deutsch: (https://aiia.li/de/tools/llm-api-price-list/)
- Englisch: [https://aiia.li/en/tools/llm-api-price-list/]