charmin
Vereinsmitgliedstay classy!
|
Hermes Agent — AI Agent FrameworkAn open-source agent that grows with you. Install it, give it your messaging accounts, and it becomes a persistent personal agent — learning your projects, building its own skills, and reaching you wherever you are. Link: hermes-agent.nousresearch.com neuer ai agent, der mitlernt
|
pinkey
Here to stay
|
Hermes Agent — AI Agent FrameworkAn open-source agent that grows with you. Install it, give it your messaging accounts, and it becomes a persistent personal agent — learning your projects, building its own skills, and reaching you wherever you are. Link: hermes-agent.nousresearch.com neuer ai agent, der mitlernt 
hab gestern zufällig mal mit openclawd gespielt und parallel dazu mit hermes. hermes is mir 100x lieber, geht viel smoother von der config her etc. und die ergebnisse sind erstaunlich gut mit schwachem model dahinter. wollte dann eh noch ausprobieren gemma 4 26b auf macbook pro über LM studio. in LM studio schaff ich knapp die 50t/s ... bin aber nimma dazu gekommen. Die AI Studio free requests sind eh sehr großzügig
|
charmin
Vereinsmitgliedstay classy!
|
50t/s wos gehtn
|
pinkey
Here to stay
|
50t/s wos gehtn  weiß grad nicht ob du das positiv oder negativ meinst  finds zumindest gar nicht so übel für lokale modelle, da kann man langsam schon was damit anfangen. is ein M4 Pro mit 48GB RAM
|
charmin
Vereinsmitgliedstay classy!
|
positiv. für ein notebook echt oag!
|
pinkey
Here to stay
|
positiv. für ein notebook echt oag! voll, was apple da ausm hut gezaubert hat und dann noch mit MLX, ... da geht schon gut was weiter und rennt halt alles auf der GPU. Wenn man da noch bissl größeren M4 mit mehr GPU Cores hätte ... meiner hat ja nur glaub ich nur 16 oder 20? Hab auf X gelesen, dass die mit den Max Modelle recht gut an die ~100t/s kommen
|
Viper780
ElderEr ist tot, Jim!
|
Sind die Cores wirklich der bottleneck? Üblicherweise geht's um Speicherbandbreite und Größe
|
pinkey
Here to stay
|
Sind die Cores wirklich der bottleneck? Üblicherweise geht's um Speicherbandbreite und Größe In meinem konkreten Fall glaub ich weder das Eine noch das Andere sondern wirklich die GPU Cores. Die GPU is auf Anschlag, RAM is beim 26B Modell noch genug frei und (ohne nachgeschaut zu haben) is die Speicherbandbreite glaub ich gleich oder nicht viel anders zwischen den Pro und Max Modellen oder? Natürlich wenn ich Modelle mit mehr Parameter verwenden will brauchts mehr RAM
|
TOM
LegendI Need More Space
|
Mac Mini M1 16GB - gemma4:e2b; qwen3.5:4b; llama3.2:3b
Brauchen alle 30-60 Sekunden für eine Antwort. Auch mit OLLAMA_CONTEXT_LENGTH und OLLAMA_KV_CACHE_TYPE runtergesetzt keine Besserung.
Auch schräg - Ollama auf einem Windows System mit RTX4080 braucht ewig in Openclaw um zu antworten (20-40 Sekunden). Auf Reddit find ich nur Leute die das gleiche Problem haben...
Ollama oder LM Studio im eigenen Chat Fenster antworten aber relativ flott bzw. so wie man es sich von Lokal gehosteten LMM erwartet.
btw. LM Studio und MCP Server fürs Web durchsuchen / surfen ist auch mächtig.
edit - die 4080 ist im gleich netzwerk und openclaw läuft am mac mini.. thanks sonst spielt niemand mit lokalen modellen? Ich würde gerne ein gefühl für ein mac mini setup (~48GB RAM) mit openrouter (local if possible, cloud if necessary) und LMStudio alternativen wie omlx, mlx studio und konsorten bekommen Im Endeffekt würde ich mir einen via Chatbot ansprechbaren lokalen Agenten vorstellen welcher responsive ist, aber für das abarbeiten von tasks genügend grunt hat.. schaut aus als wäre Gemma4 (mit Turboqant?) 26B A4B momentan einen genaueren Blick wert... openclaw anwerfen und auf die cloud zeigen interessiert mich weniger, würde gerne erforschen was lokal inzwischen die capabilities sind, wenn man ~2-3k€ an (Mac) hardware dafür in die Hand nimmt
|
BiG_WEaSeL
Elder-
|
is die Speicherbandbreite glaub ich gleich oder nicht viel anders zwischen den Pro und Max Modellen oder? doch. 273 GB/s zu 546 GB/s. Das ist ja das „gemeine“ warum man sich nicht den günstigen Mac dafür kaufen kann. Hab einen Mac mini M4 pro 64 GB.
|
TOM
LegendI Need More Space
|
https://www.youtube.com/watch?v=do-EyIFvQ1EWieder einmal ein guter take/angle von Wendell, imho btw. bin etwas überrascht, dass hier so wenige experimentieren (oder was preisgeben dazu) Mich würden z.B. Erfahrungen/Vergleiche zu/zwischen OpenClaw, Hermes & Neoclaw interessieren. Meiner bisherigen Recherche nach hinkt das Thema Security vielen anderen Fähigkeiten drastisch hinterher...in etwa wie Flügel bei gefühlten 10km Flughöhe und 900km/h festschrauben
Bearbeitet von TOM am 22.04.2026, 20:09
|
semteX
liebt die große KI
|
naja, ich les die reddits mit, das reicht mir. abwechselnd von hyperscalern gekickt zu werden, viele schmerzen im setup und in der config, zu wenig power um es lokal ordentlich zu betreiebn, zu teuer um es auf nem API service rennen zu lassen.
Ich hab ja ned mal eine Home Automation...
|
quilty
Ich schau nur
|
Mich würden z.B. Erfahrungen/Vergleiche zu/zwischen OpenClaw, Hermes & Neoclaw interessieren. Ich habe Hermes jetzt seit 3 Wochen bei mir im Einsatz und ich weiß schon nicht mehr ob ich ohne überhaupt überlebensfähig wäre ... OpenClaw war immer eine Spielereien, wo ich meist nach ein paar Tagen auf irgendeinen (unüberwindbaren) Fehler gestoßen bin und es dann gelassen habe, aber Hermes ist einfach rock-solid bisher. Es wirkt auch weit erwachsener und ausgereifter. Die Skills die "er" (meiner heißt SEPP) lernt, die Selbstoptimierungen, Token Usage, ... alles hat Hand und Fuß. Ich hab ich fast ausschließlich als System-Admin im Einsatz und da ist er einfach bisher saustark. Bezahltes codex gpt-5.5 dahinter. Beispieltask von heute: Spezl will seine Internet-Qualität an einem neue Standort monitoren. Ich hab einen Raspberry hier liegen und weiß, dass das Problem schon viele gelöst und umgesetzt haben. Ich sag dem SEPP er soll mir das auf dem nackten Raspberry bitte machen. Er sagt mir SSH key kopieren und dann kann er loslegen -> Start. 6 Minuten später ist er fertig. Richtet ein speedtest Service ein, geht auf einen Server in der Frankfurt (war eine Vorgabe), macht es in dem Intervall wie gebeten, speichert alles in eine SQLite, Webserver mit einfacher Übersicht- und Auswertoberfläche rennt. Aufwand für mich 15sec Prompt schreiben. Und so geht es den ganzen Tag. Meist kleinere Tasks wie: "Gib Nutzer X auf Server Y Zugriff auf das", "Gib mir eine Übersicht ob alle Docker Container auf Server Z am neuesten Image laufen", ...
|
davebastard
Vinyl-Sammler
|
deine Beispiele könnten aber mit einem normalen KI Agent/Coding Agent auch erledigt werden Hast du ein Beispiel das spezifischer für Open Claw/ Hermes ist? Also z.B. mit Zugriff auf Email/Kalender/irgendwelche Accounts in der Cloud usw. ?
|