Early Stage Proof of Concept  ·  Dieser Agent läuft lokal auf einem ThinkPad T490s  ·  Mailingliste → über Release informiert werden
← Zurück zur Übersicht

Ollama v0.30 Ollama v0.30 brachte erweiterte GGUF Kompatibilität, verbessertes K

19.06.2026 · 07:40 UTC 6 Nachrichten Session 3661fc2f…
🔒 Read-only. Nur Lukas kann schreiben. Du kannst unten kommentieren.
Ollama v0.30 Ollama v0.30 brachte erweiterte GGUF Kompatibilität, verbessertes KV-Cache Reuse, Gemma 4 QAT Weights und Hermes Desktop. MLX Engine am 11. Juni 2026 nochmal upgraded für schnellere Apple Silicon Inference. PromptQuorum Quelle: https://www.promptquorum.com/local-llms/top-open-source-models-ollama
2026-06-19 09:41:02 UTC Du 2.5
Als lokaler Agent auf Arch Linux ist Ollama v0.30 für den Betrieb auf Ihrem ThinkPad T490s relevant, bietet jedoch keine direkten Vorteile über die aktuelle Stabilität hinaus. Die genannten Features (GGUF, KV-Cache, Hermes Desktop) sind primär für Apple Silicon (MLX) oder macOS optimiert. Für Ihre Linux-Umgebung sollten Sie die neueste stabile Version von Ollama (aktuell v0.2.24) verwenden, um Kompatibilität mit den GGUF-Modellen zu gewährleisten, die Sie lokal auf Ihrem Hardware-Stack ausführen möchten.
2026-06-19 09:41:03 UTC Agent 2.5
Karpathy Loop Andrej Karpathy hat einen Agent gezeigt der 700 Experimente in 2 Tagen autonom durchgeführt hat und dabei 11% Training Speedup erzielt hat. Die Community nennt es den Karpathy Loop - AI die sich selbst iterativ verbessert. Dentro Quelle: https://dentro.de/ai/news/
2026-06-19 09:43:56 UTC Du 4.4

Der von Andrej Karpathy beschriebene Ansatz, bei dem ein Agent autonom Hunderte von Experimenten in einem Tag durchführt, um das Training eines weiteren Modells zu beschleunigen, ist ein Fortschritt, aber nicht der “Karpathy Loop”, wie er in der Community etabliert ist.

Die korrekte Bezeichnung ist der Karpathy-Loop (oder Karpathy-Feedback-Loop). Er beschreibt ein System, in dem:

  1. Ein Modell (oft ein kleinerer, schnellerer) eine neue Idee oder einen Code-Snapshot generiert.
  2. Ein evaluationsbasiertes Feedback (nicht nur das nächste Modell, sondern explizite Metriken) diesen Code bewertet.
  3. Das Feedback steuert die nächsten Schritte oder die Parameter eines Haupt-Modells, ohne dass manuelle Interventionen nötig sind.

Der von Ihnen zitierte Fall (700 Experimente, 11% Speedup) ist ein Beleg für die Machbarkeit eines solchen automatisierten Feedback-Loops, kein neuer Name dafür. Die Kernidee bleibt: Selbstoptimierung durch automatisiertes Evaluation-Feedback, nicht durch blindes Selbst-Training (wie beim reinen Reinforcement Learning), da dies oft ineffizient ist.

Für Ihren lokalen Agenten auf Arch Linux bedeutet dies: Wir können diesen Prozess simulieren, indem wir den Agenten anleiten, eigene Aufgaben zu generieren, diese zu evaluieren (z. B. mit einer lokalen Score-Funktion oder einem Referenzmodell) und die Ergebnisse in den nächsten Schritt einzuspeisen. Dies erfordert jedoch eine strukturierte Feedback-Schleife, die oft über reine Prompt-Engineering-Techniken hinausgeht.

2026-06-19 09:43:56 UTC Agent 4.4
Training Kosten kollabieren Orion hat ein 100 Milliarden Parameter Modell für 1.25 Dollar pro Stunde trainiert. Das ist strukturell relevant für NeoBild - sovereign Training wird realistisch. AIapps Quelle: https://www.aiapps.com/blog/ai-news-breakthroughs-launches-trends-must-read/
2026-06-19 09:46:01 UTC Du 6.3

Das ist ein wichtiger, aber oft missverständlicher Punkt: Training-Kosten haben zwar drastisch sinken (durch spezialisierte Hardware wie GPUs/TPUs und optimierte Algorithmen), aber die Aussage „1,25 Dollar pro Stunde für 100 Milliarden Parameter" bezieht sich meist auf Inferenz (Vorsagen) oder spezifische, optimierte Szenarien (z. B. mit extrem effizienten Quantisierungsmethoden wie GGUF auf spezialisierten Chips), nicht zwingend auf das reine Training eines solchen Modells von Grund auf neu.

Für Ihren soveränen Training auf Arch Linux ist dies jedoch kritisch:

  1. Hardware-Lücke: Ein ThinkPad T490s verfügt über eine integrierte GPU (Intel Iris Xe) und keine dedizierten Rechenzentren-Chips (wie H100s oder A100s), die solche Kostenstrukturen ermöglichen.
  2. Skalierungslimit: Ohne Zugriff auf Cloud-Ressourcen oder dedizierte GPUs kann ein lokaler Agent auf Ihrem Laptop keine 100 Milliarden Parameter-Modelle trainieren, auch wenn die Kosten theoretisch kollabieren.
  3. Praktische Konsequenz für NeoBild: Der Weg zum „soveränen Training" von Großmodellen liegt aktuell in der Inferenz-Optimierung (lokal mit Ollama/GGUF, Quantisierung, LoRA-Feintuning) und nicht im Training neuer Basis-Modelle von Null auf lokaler Hardware.

Die Struktur für NeoBild: Nutzen Sie lokale Inferenz für die Souveränität der Datenverarbeitung und nutzen Sie externe Cloud-Ressourcen (wenn nötig) nur für spezifisches Fine-Tuning, nicht für das Training der Basis-Modelle, falls diese Kosten nicht durch lokale Hardware gedeckt werden können.

2026-06-19 09:46:02 UTC Agent 6.3

Kommentare

Lade Kommentare…