Hermes Agent houdt alles op je eigen machine: je bestanden, je shell, je geschiedenis. Op één ding na. Elke beurt van de agentloop gaat naar een model, en daarmee gaat je broncode de deur uit. Zet die ene regel om naar Appelon en ook dat blijft in Nederland.

Hermes praat met elk endpoint dat de OpenAI chat-completions API spreekt. Kies bij hermes setup de optie custom endpoint, of zet het rechtstreeks in ~/.hermes/config.yaml. Geen plugin, geen fork, geen wachten op ondersteuning.
Een coding agent doet niet één vraag met wat context erbij. Hij leest bestanden, draait commando's, leest de uitvoer, en stuurt dat allemaal opnieuw mee. Waar dat terechtkomt is een keuze die je één keer maakt.
Van prompt tot antwoord draait alles op onze eigen GPU's in een ISO 27001-gecertificeerd datacenter in Groningen. Geen Amerikaanse cloud, geen doorgifte die je later moet uitleggen.
Je repository wordt verwerkt en teruggegeven, meer niet. We trainen er geen modellen mee. Verwerkersovereenkomst beschikbaar.
Hermes is open source, de modellen die je aanroept ook. Geen enkel deel van je workflow zit vast aan één leverancier die morgen de voorwaarden wijzigt.
Elk bestand dat de agent leest en elk tool-resultaat blijft in het gesprek staan. Begin daarom met qwen. Hermes comprimeert zijn context als het venster volloopt, maar hoe groter het venster, hoe minder vaak dat hoeft.
| Model | Type | Snelheid |
|---|---|---|
| Agentwerk · 256K context | ~45 tok/s | |
| Korte taken · 64K context | ~60 tok/s |
Dat komt een coding agent goed uit, want die leest veel en schrijft weinig. Alles telt mee in je vaste maandbedrag, dus een agent die een nacht doorwerkt levert geen verrassingsrekening op.
Hermes Agent is een open-source autonome AI-agent van Nous Research, uitgebracht onder de MIT-licentie. Hij draait als CLI of TUI, heeft tools voor bestanden, shell en webzoeken, en koppelt met VS Code, Zed en JetBrains. Alles wat Hermes zelf opslaat blijft op je eigen machine; de enige uitgaande verbinding is de call naar het model. Naar de site van Hermes Agent →
Ja. Hermes praat met elk endpoint dat de OpenAI chat-completions API spreekt. Kies bij hermes setup de optie custom endpoint, vul https://router.appelon.ai/v1 in als base URL en je Appelon-key, en je agent draait op modellen in Groningen. Lees de installatiegids →
Qwen 3.8 27B, in de API bekend als qwen. Die heeft 256K context, en dat is precies wat een agentsessie opeet. Gemma 4 31B is sneller en sterker in het Nederlands, maar heeft 64K context. Bekijk alle modellen →
Nee. De inference draait op onze eigen GPU's in een ISO 27001-gecertificeerd datacenter in Groningen. Je code wordt verwerkt en teruggegeven, en niet gebruikt om modellen te trainen. Bekijk de verwerkersovereenkomst →
Agents lezen veel en schrijven weinig, en lezen is bij ons 25 keer goedkoper dan schrijven: 0,04 unit per 1.000 tokens invoer tegen 1 unit per 1.000 tokens uitvoer. Een sessie waarin de agent 1 miljoen tokens aan code leest en 50.000 tokens terugschrijft kost ongeveer 90 units. Zo meten we verbruik →
Ja. Tool calling is beschikbaar op beide chatmodellen, en dat is wat een agentloop laat werken. Wat nog niet kan is beeldinvoer, dus een Hermes-skill die een screenshot moet lezen werkt niet.
Ja. Alles wat je op een OpenAI-compatibele base URL kunt richten werkt: agents, IDE-plugins, workflow-tools als n8n en frameworks als LangChain. Hermes is niet de uitzondering, het is het voorbeeld. Zo koppel je n8n →
Dat kan, en soms is dat het juiste antwoord. Maar dan beheer je GPU's in plaats van je product: drivers, geheugen, wachtrijen en uptime. Wij draaien dezelfde open modellen en jij belt een API.
€5 gratis tegoed, geen creditcard. Drie regels in je config en je codebase blijft in Nederland.
Hermes Agent is een project van Nous Research. De naam en het logo zijn hun handelsmerk en worden hier ongewijzigd gebruikt om naar hun project te verwijzen. Appelon is niet gelieerd aan Nous Research en wordt er niet door onderschreven.