OpenAI-compatibel, ISO-gecertificeerd, AVG-native. Eén regel code om over te stappen.
× Torgon.io · Echte GPU's in GroningenJe bouwt voor klanten in recht, zorg of overheid, waar data niet naar de VS mag. Zet je bestaande OpenAI-SDK om met één regel code en beloof compliance die je kunt waarmaken.
Voor overheid, zorg en publieke organisaties met een eigen IT-afdeling. Elk verzoek blijft in Groningen, met verwerkersovereenkomst en audit-logging klaar voor je security review.
Inference, compliance en facturatie in één platform, zonder de juridische rompslomp van Amerikaanse providers.
Elk verzoek draait en blijft in Groningen. Geen verzoeken naar het buitenland.
AVG-compliance en audit-logging zitten er standaard in. Bij een audit lever je gewoon de rapporten aan.
Qwen, Gemma en meer achter één OpenAI-compatibele API. Wissel van model met één regel code.
Eén OpenAI-compatibel endpoint voor elk model. Verwijs je bestaande client naar Appelon en je eerste verzoek draait meteen in de EU.
Productie-ready open-source modellen op dedicated GPU's in Groningen.
| Model | Type | Snelheid |
|---|---|---|
| Chat | 99 tok/s | |
| Chat | ~80 tok/s | |
| Embeddings | instant | |
| Afbeelding | ~2s/afbeelding | |
| Transcriptie | real-time |
Een vast bedrag per maand, dus je weet vandaag al wat je in december betaalt.
Maandelijks opzegbaar. Je betaalt vooraf een vast bedrag en daar komt achteraf niets meer bij. Zo meten we verbruik →
Dedicated GPU-capaciteit, custom modellen, SLA en een verwerkersovereenkomst op maat. Voor organisaties met compliance- en volume-eisen.
Direct antwoord op de meest gestelde vragen over Appelon.
Appelon is een AI inference platform dat open-source modellen draait op dedicated GPU's in Groningen, Nederland. Het biedt een OpenAI-compatible API waarmee je AI-functionaliteit kunt integreren in je applicaties, volledig AVG-compliant.
Ja, volledig. Alle data blijft binnen de EU (Groningen, Nederland). Geen trans-Atlantische dataoverdracht. De infrastructuur draait in een ISO 27001-gecertificeerd datacenter, met ingebouwde audit-logging.
Qwen 3.6 35B en Gemma 4 31B voor chat, BGE-M3 voor embeddings, FLUX Schnell voor afbeeldingen, en WhisperX voor audio transcriptie met sprekerherkenning. Meer over audio transcriptie →
Verander de base_url naar router.appelon.ai/v1 in je bestaande OpenAI SDK. Geen andere code-aanpassingen nodig.
Gratis tier met €5 tegoed. Lite is €49/maand met 150 units voor solo-devs. Starter is €150/maand met 600 units voor teams in productie. Pro is €350/maand met 3.000 units, priority support en wachtrij-prioriteit. Enterprise is op maat; plan een gesprek voor dedicated capaciteit, custom modellen en een SLA.
1 usage unit = 1.000 gegenereerde tokens (output). Input tokens tellen 0,04 unit per 1.000. Afbeeldingen kosten 3,5 units per stuk. Audiotranscriptie kost 0,25 units per minuut. Embeddings kosten 0,05 units per 1.000 tokens. Zo meten we verbruik →
Ja. Voor dedicated GPU-capaciteit, custom modellen of een SLA neem je contact met ons op. Plan een gesprek →
Alle GPU-servers staan in Groningen, Nederland: fysieke infrastructuur die je kunt bezoeken, beheerd door een Nederlands bedrijf onder Nederlandse wet.
Probeer het gratis met €5 tegoed. De API ken je al.