Dieselben Funktionen laufen auf Chips verschiedener Architekturen. Die Bedienung oben ist identisch; unterschiedlich ist, wie vollständig die jeweilige Hardware darunter ausgenutzt wird.
Aufgebaut auf llama.cpp, ONNX Runtime und MLX, wobei Backend und Quantisierung je nach Chip gewählt werden. Keine manuelle Konfiguration nötig.
Wir ergänzen die Unterstützung Modell für Modell. Nennen Sie uns Ihr Gerät und was Sie damit vorhaben.