Ai

LLM-ASICs und spezialisierte Inferenz-Chips (weshalb sie wichtig sind)

LLM-ASICs und spezialisierte Inferenz-Chips (weshalb sie wichtig sind)

ASICs und maßgeschneiderte Chips steigern die Geschwindigkeit und Effizienz der LLM-Inferenz

Die Zukunft der KI dreht sich nicht nur um intelligentere Modelle. Es geht auch um Silizium, das dazu passt, wie diese Modelle tatsächlich bereitgestellt werden. Spezialisierte Hardware für LLM-Inferenz folgt einem Weg, der an den Übergang beim Bitcoin-Mining von GPUs zu zweckgebauten ASICs erinnert, nur mit härteren Einschränkungen, da sich Modelle und Präzisionsverfahren ständig weiterentwickeln.

DGX Spark vs. Mac Studio: Ein preisgeprüfter Blick auf NVIDIAs persönliches KI-Supercomputer

DGX Spark vs. Mac Studio: Ein preisgeprüfter Blick auf NVIDIAs persönliches KI-Supercomputer

Verfügbarkeit, reale Straßenpreise in sechs Ländern und Vergleich mit dem Mac Studio.

NVIDIA DGX Spark ist Realität, ab dem 15. Oktober 2025 verfügbar und richtet sich an CUDA-Entwickler, die lokale LLM-Arbeitslasten mit einem integrierten NVIDIA AI-Stack benötigen. Der US-Empfehlungspreis liegt bei 3.999 USD; der Einzelhandelspreis in UK/DE/JP ist aufgrund der MwSt. und des Vertriebswegs höher. Öffentliche Aufkleberpreise für AUD/KRW sind noch nicht weit verbreitet.

Ollama-Enshittification – Die ersten Anzeichen

Ollama-Enshittification – Die ersten Anzeichen

Meine Sicht auf den aktuellen Entwicklungsstand von Ollama

Ollama ist schnell zu einem der beliebtesten Tools für den lokalen Betrieb von LLMs geworden. Sein einfaches CLI und das durchdachte Modell-Management haben es zu einer ersten Wahl für Entwickler gemacht, die mit KI-Modellen außerhalb der Cloud arbeiten möchten.

Chat-Oberflächen für lokale Ollama-Instanzen

Chat-Oberflächen für lokale Ollama-Instanzen

Schneller Überblick über die wichtigsten UIs für Ollama im Jahr 2025

Locally gehostete Ollama ermöglicht es, große Sprachmodelle auf Ihrem eigenen Gerät auszuführen, aber die Verwendung über die Befehlszeile ist nicht benutzerfreundlich. Hier sind mehrere Open-Source-Projekte, die ChatGPT-ähnliche Schnittstellen bereitstellen, die mit einer lokalen Ollama verbunden sind.

Objekterkennung mit TensorFlow

Objekterkennung mit TensorFlow

Vor einiger Zeit habe ich eine Objekterkennungs-KI trainiert

An einem kalten Wintertag im Juli… das ist in Australien… verspürte ich ein dringendes Bedürfnis, ein KI-Modell zum Erkennen von unverkapselten Stahlbewehrungsstäben zu trainieren…