Modelle auf deinem Computer
Nutze Ollama auf allen unterstützten Plattformen. Windows bietet zusätzlich eine integrierte Engine mit Schnelleinrichtung.
Nach dem Modelldownload funktioniert lokale Inferenz offlineVom ersten Gedanken zum fertigen Ergebnis.
AetherAI herunterladen: KI-Chat mit lokalen Modellen, OpenRouter, Groq, Gemini, Cerebras und SambaNova. Agenten, Werkzeuge und Antwortpräferenzen.
Windows · macOS · Linux · Lokale Inferenz ohne Abo

01 / MÖGLICHKEITEN
Wähle passende Modelle und Werkzeuge für deine Aufgabe.
Nutze Ollama auf allen unterstützten Plattformen. Windows bietet zusätzlich eine integrierte Engine mit Schnelleinrichtung.
Nach dem Modelldownload funktioniert lokale Inferenz offlineEin Koordinator verteilt geeignete Teilaufgaben an Spezialisten. Du siehst ihren Fortschritt, während das Hauptmodell die Ergebnisse zusammenführt.
Bis zu zwei Spezialisten · Tempo abhängig von Modell und HardwareVerbinde MCP-Server und Markdown-Skills. Workspace liest deine Projekte mit den von dir festgelegten Berechtigungen.
MCP · Skills · Aktionsfreigaben02 / IN DER APP
Beginne lokal und ergänze Werkzeuge und Cloud-Modelle nach Bedarf.
Die Windows-Schnelleinrichtung lädt Engine und Qwen 1.5B. Unter macOS und Linux installierst du Ollama.
Modelle werden separat heruntergeladen. Größere Modelle benötigen mehr Speicher.
03 / DU BEHÄLTST DIE KONTROLLE
Lokaler Chat ist kostenlos. Anbieter haben eigene kostenlose Limits und kostenpflichtige Tarife. Cloud-Modelle benötigen einen API-Schlüssel.
Wähle Berechtigungen. Der Planungsmodus deaktiviert MCP; im Freigabemodus siehst du jede Aktion vor der Ausführung.
Eine ruhige Oberfläche, animierte Saiten und Discord Activity. Passe deinen Arbeitsbereich an.
BEREIT FÜR DEINE ERSTE IDEE?
Wähle dein System und installiere AetherAI.
x64 · Installationsdatei
Für Windows herunterladen Portable ↗Apple Silicon · arm64
Für macOS herunterladen Intel-Mac ↗x64 · AppImage
Für Linux herunterladen Ubuntu / Debian (.deb) ↗Version 1.24.1
Unter macOS und Linux nutzt du Ollama für lokale Modelle oder Ollama Cloud. Windows bietet zusätzlich die integrierte Engine.
Die macOS-Versionen sind nicht von Apple signiert oder notarisiert.
NOCH EIN PAAR FRAGEN
Lokaler Chat ist kostenlos. Anbieter haben eigene kostenlose Limits und kostenpflichtige Tarife. Cloud-Modelle benötigen einen API-Schlüssel.
Kleine Modelle können auf der CPU laufen. Leistung und Modellgröße hängen von Hardware und Speicher ab. Cloud-Modelle benötigen keine lokale GPU.
Unter Windows x64: llama.cpp und Qwen 2.5 1.5B, etwa 1,14 GB, bei Bedarf auch Microsoft Visual C++. macOS und Linux nutzen Ollama.
Linux: .deb unter Ubuntu/Debian installieren oder AppImage ausführbar machen und starten; eventuell wird FUSE benötigt. Mac: DMG öffnen und AetherAI in Programme ziehen. Die unsignierte App muss eventuell unter Datenschutz & Sicherheit freigegeben werden.
Öffne GitHub Issues und nenne Version, Modell und Schritte zur Reproduktion. GitHub Issues ↗