Hermes Agent

Je coding agent draait lokaal. Laat het model dat ook doen.

Hermes Agent houdt alles op je eigen machine: je bestanden, je shell, je geschiedenis. Op één ding na. Elke beurt van de agentloop gaat naar een model, en daarmee gaat je broncode de deur uit. Zet die ene regel om naar Appelon en ook dat blijft in Nederland.

Geen creditcard · €5 gratis tegoed · AVG-native
Hermes Agent, een project van Nous Research
Zo werkt het

Drie regels in je config, klaar.

Hermes praat met elk endpoint dat de OpenAI chat-completions API spreekt. Kies bij hermes setup de optie custom endpoint, of zet het rechtstreeks in ~/.hermes/config.yaml. Geen plugin, geen fork, geen wachten op ondersteuning.

Tool calling voor bestanden, shell en zoeken
Streaming output in de TUI
256K context voor lange agentsessies
# ~/.hermes/config.yaml
model:
default: qwen
provider: custom
base_url: https://router.appelon.ai/v1
# ~/.hermes/.env
APPELON_API_KEY=sk-appelon-...
# vanaf nu draait elke beurt in Groningen
Waarom dit uitmaakt

Een agent leest meer van je codebase dan je collega's.

Een coding agent doet niet één vraag met wat context erbij. Hij leest bestanden, draait commando's, leest de uitvoer, en stuurt dat allemaal opnieuw mee. Waar dat terechtkomt is een keuze die je één keer maakt.

Je code blijft in Nederland

Van prompt tot antwoord draait alles op onze eigen GPU's in een ISO 27001-gecertificeerd datacenter in Groningen. Geen Amerikaanse cloud, geen doorgifte die je later moet uitleggen.

Geen training op jouw code

Je repository wordt verwerkt en teruggegeven, meer niet. We trainen er geen modellen mee. Verwerkersovereenkomst beschikbaar.

Open modellen, open agent

Hermes is open source, de modellen die je aanroept ook. Geen enkel deel van je workflow zit vast aan één leverancier die morgen de voorwaarden wijzigt.

Modelkeuze

Voor agents: context wint.

Elk bestand dat de agent leest en elk tool-resultaat blijft in het gesprek staan. Begin daarom met qwen. Hermes comprimeert zijn context als het venster volloopt, maar hoe groter het venster, hoe minder vaak dat hoeft.

ModelTypeSnelheid
Qwen 3.8 27B
Agentwerk · 256K context~45 tok/s
Gemma 4 31B
Korte taken · 64K context~60 tok/s
Bekijk alle modellen →
Kosten

Lezen is 25× goedkoper dan schrijven.

Dat komt een coding agent goed uit, want die leest veel en schrijft weinig. Alles telt mee in je vaste maandbedrag, dus een agent die een nacht doorwerkt levert geen verrassingsrekening op.

0,04
unit per 1.000 tokens invoer
1
unit per 1.000 tokens uitvoer
150
units per maand bij Lite (€49)
600
units per maand bij Starter (€150)
Start gratisBekijk alle abonnementen Zo meten we verbruik
Veelgestelde vragen

Vragen over Hermes Agent.

Wat is Hermes Agent?

Hermes Agent is een open-source autonome AI-agent van Nous Research, uitgebracht onder de MIT-licentie. Hij draait als CLI of TUI, heeft tools voor bestanden, shell en webzoeken, en koppelt met VS Code, Zed en JetBrains. Alles wat Hermes zelf opslaat blijft op je eigen machine; de enige uitgaande verbinding is de call naar het model. Naar de site van Hermes Agent →

Werkt Hermes Agent met Appelon?

Ja. Hermes praat met elk endpoint dat de OpenAI chat-completions API spreekt. Kies bij hermes setup de optie custom endpoint, vul https://router.appelon.ai/v1 in als base URL en je Appelon-key, en je agent draait op modellen in Groningen. Lees de installatiegids →

Welk model kan ik het beste gebruiken?

Qwen 3.8 27B, in de API bekend als qwen. Die heeft 256K context, en dat is precies wat een agentsessie opeet. Gemma 4 31B is sneller en sterker in het Nederlands, maar heeft 64K context. Bekijk alle modellen →

Verlaat mijn broncode Nederland?

Nee. De inference draait op onze eigen GPU's in een ISO 27001-gecertificeerd datacenter in Groningen. Je code wordt verwerkt en teruggegeven, en niet gebruikt om modellen te trainen. Bekijk de verwerkersovereenkomst →

Wat kost een agentsessie?

Agents lezen veel en schrijven weinig, en lezen is bij ons 25 keer goedkoper dan schrijven: 0,04 unit per 1.000 tokens invoer tegen 1 unit per 1.000 tokens uitvoer. Een sessie waarin de agent 1 miljoen tokens aan code leest en 50.000 tokens terugschrijft kost ongeveer 90 units. Zo meten we verbruik →

Werken de tools van Hermes?

Ja. Tool calling is beschikbaar op beide chatmodellen, en dat is wat een agentloop laat werken. Wat nog niet kan is beeldinvoer, dus een Hermes-skill die een screenshot moet lezen werkt niet.

Werkt het ook met andere tools?

Ja. Alles wat je op een OpenAI-compatibele base URL kunt richten werkt: agents, IDE-plugins, workflow-tools als n8n en frameworks als LangChain. Hermes is niet de uitzondering, het is het voorbeeld. Zo koppel je n8n →

Kan ik dan niet beter zelf een model hosten?

Dat kan, en soms is dat het juiste antwoord. Maar dan beheer je GPU's in plaats van je product: drivers, geheugen, wachtrijen en uptime. Wij draaien dezelfde open modellen en jij belt een API.

Verhuis je agent vanavond nog.

€5 gratis tegoed, geen creditcard. Drie regels in je config en je codebase blijft in Nederland.

Hermes Agent is een project van Nous Research. De naam en het logo zijn hun handelsmerk en worden hier ongewijzigd gebruikt om naar hun project te verwijzen. Appelon is niet gelieerd aan Nous Research en wordt er niet door onderschreven.