UN NewsWHO releases first global guidelines on child obesity as cases surgeESPN📈 Ovechkin's retirement announcement sparks major ticket price hikePunchBarcelona hails Messi’s remarkable career with ArgentinaThe Jerusalem PostHamam al-Hammami hired by flydubai as part of airline's mass hiring push - reportBollywood HungamaGuneet Monga Kapoor-led Women in Film India and Google Flow join hands to enable AI-powered filmmaking for new creative possibilitiesInquirerDTI maps halal calamansi supply chain in Oriental MindoroCapital FMPharmacists told to be on alert as Kenya confirms imported Ebola caseZDF heuteAktuelle Pressemitteilungen des ZDFCollider‘Mistborn’ Movie Script Is Officially Finished as Brandon Sanderson Reveals Next Step [Exclusive]SDP EspectáculosReseña de Carrie: una buena actualización de Prime Video, pero ¿dónde quedó el horror?Daily MaverickDANCE REVIEW: Elysium — 4 dances of bliss and seduction, transcendence and joy from Cape Ballet AfricaGIGAZINEChatGPTが生成したマンガに「実在するマンガ家の署名」が含まれているとの指摘
The Daily Newsstand · Free, Always
Wednesday, October 7, 2026

Lokale KI auf dem Mac: Ollama nutzt MLX als Standard

Translate

Ollama 0.40.0 führt Modelle auf Apple-Silicon-Macs jetzt standardmäßig über MLX aus, sofern MLX ihre Architektur unterstützt. Das Update erweitert außerdem die MLX-Unterstützung auf weitere Sprachmodelle, Entscheidungsmodelle und ein Embedding-Modell.

Ollama ist eine Open-Source-Software, mit der sich KI-Modelle herunterladen, verwalten und auf dem eigenen Rechner ausführen lassen. Über die Kommandozeile kann man direkt mit den Modellen arbeiten; über einen lokalen API-Server lassen sie sich in Anwendungen einbinden. Wie das in der Praxis funktioniert, erklärt iX im Artikel „Sprachmodelle lokal betreiben“.

Die automatische Umstellung gilt nicht pauschal für jedes Modell, sondern nur für Architekturen, die von Ollamas MLX-Laufzeit unterstützt werden. MLX ist Apples quelloffenes Framework für maschinelles Lernen auf Apple-Silicon-Chips. In den kurzen Release Notes zu Ollama 0.40.0 beschreibt das Projekt die neue Standardwahl.

Zu den dort zusätzlich aufgeführten Modellen gehören Gemma 4, Qwen 3.6 und Qwen 3.5. Zum Herunterladen und Starten eines Modells dienen weiterhin die üblichen Befehle ollama pull und ollama run. Die Release Notes zeigen das am Beispiel von Qwen 3.8.

Über MLX laufen jetzt auch die Entscheidungsmodelle Nimble, Tev1, Clef und Clef Flash. Anders als ein Chatmodell erzeugen solche Modelle keine freie Textantwort, sondern liefern etwa Auswahlentscheidungen oder Bewertungen. Ein Anwendungsfall ist die Zuordnung eingehender Tickets zu Kategorien.

Mit EmbeddingGemma 2 unterstützt die MLX-Laufzeit außerdem ein Embedding-Modell. Es wandelt Inhalte in Vektoren um, die sich beispielsweise für eine Ähnlichkeitssuche vergleichen lassen. Weitere Modelle wollen die Ollama-Entwickler nach eigenen Angaben erst testen und dann für MLX freischalten.

View the original on heise online →

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.