Live ChatGPT verweigert Tool-Calls für app-only MCP-Tools

Quantisierung

Verkleinern eines Modells durch gröbere Zahlen.

Aktualisiert: 11.07.2026

Quantisierung senkt den Speicher- und Rechenbedarf eines Modells, indem seine Zahlenwerte mit geringerer Genauigkeit dargestellt werden, etwa als 8- statt 16-Bit-Werte. So laufen große Modelle auch auf schwächerer Hardware, meist mit nur geringem Qualitätsverlust.