Multimodale Magie: Code als Bild spart 60% LLM-Kosten, KI-Chips: Leistung pro Dollar explodiert – AMD fordert Nvidia heraus — AI Digest 04.07.2026
Archiv nur für Abonnenten
Dieser Digest ist älter als 7 Tage. Das vollständige Archiv ist bald als Abo verfügbar.
Multimodale Magie: Code als Bild spart 60% LLM-Kosten
Ein neuer, fast schon absurder Hack namens pxpipe verspricht, die Kosten für das Verarbeiten von Code durch Large Language Models (LLMs) um bis zu 60% zu senken. Der Trick? Anstatt den Code direkt als Text einzugeben, wird er zuerst in ein Bild umgewandelt und dann von einem multimodalen Modell per OCR gelesen. Das klingt verrückt, offenbart aber eine Schwachstelle in den Token-Preismodellen und wie wir LLMs füttern sollten.
Warum wichtig: Dieser unkonventionelle Ansatz zeigt, wie tiefgreifend man durch kreative Datentransformation LLM-Kosten optimieren kann – ein Muss für jede AI-Strategie.