Vragen
Veelgestelde vragen over OneVeer.
Korte antwoorden op de vragen die beoordelaars eerst stellen. Dezelfde antwoorden worden gepubliceerd in de gestructureerde gegevens van de pagina.
Wat is een LLM-gateway?
Een LLM-gateway (ook wel AI-gateway of inferentiegateway genoemd) is een server tussen applicaties en modellen. Toepassingen roepen één eindpunt aan; de gateway authenticeert ze, kiest het model of de aanbieder, past beleid toe en registreert wat er is gebeurd. OneVeer is een LLM-gateway die in hetzelfde proces ook de modellen zelf op uw eigen hardware uitvoert.
Is OneVeer een alternatief voor vLLM?
Voor een andere baan. vLLM is een Python-serveersysteem dat is gebouwd voor datacenterdoorvoer op GPU-clusters. OneVeer richt zich op een enkel knooppunt dat u beheert: één native server die een llama.cpp inferentie-engine (CPU, Vulkan, CUDA) combineert met een gateway, een beleidsengine en providerroutering. Kies vLLM voor weergave op clusterschaal; kies OneVeer als de vereiste een beheerde gateway is die draait waar uw gegevens zich bevinden.
Is OneVeer een alternatief voor Ollama?
Ollama is een lokale modelrunner gericht op individuele ontwikkelaars. OneVeer is gebouwd om lokale modellen voor applicaties en teams te plaatsen: applicatiesleutels met modelsubsidies en -limieten, een gepubliceerde modelcatalogus, routering naar cloudproviders met fallback en budgetten, modellen beschermen tegen snelle injectie, PII-redactie, een noodstop, Prometheus-statistieken en OpenTelemetry-export. Beide gebruiken de stapel llama.cpp/ggml voor lokale gevolgtrekking.
Werkt OneVeer met de SDK's OpenAI en Anthropic?
Ja. OneVeer bedient OpenAI-compatibele eindpunten voor chat, voltooiingen, insluitingen en modellen en het eindpunt Anthropic berichten. Wijs de basis-URL van de SDK op OneVeer en bewaar de clientcode. Claude Code, Cursor, Codex CLI, LangChain, n8n, LibreChat en elke OpenAI-compatibele tool werken op dezelfde manier.
Op welke hardware draait OneVeer?
CPU-, NVIDIA-, AMD- en Intel GPU's tot en met Vulkan (de standaardbuild) en NVIDIA GPU's tot en met CUDA. Windows 11 is het gevalideerde platform; Linux- en macOS-builds zijn nog niet gecertificeerd. OneVeer rangschikt elk model tegen het vrije geheugen en plaatst het op een GPU, over GPU's heen, als een MoE-hybride met experts op het gebied van RAM, of op de CPU.
Verlaten gegevens mijn machine?
Alleen via een providerroute die u hebt geconfigureerd. Lokale modellen worden uitgevoerd binnen het OneVeer-proces. Een hoofdschakelaar of een per-request-header pint verzoeken naar lokale modellen. OpenTelemetry-export is standaard uitgeschakeld en bevat nooit aanwijzingen, voltooiingen, tool-payloads of sleutels.
Hoe gaat OneVeer om met snelle injectie en persoonlijke gegevens?
Guard-modellen (Prompt Guard 2, ProtectAI DeBERTa v3, Llama Guard 3 en Granite Guardian HAP) inspecteren invoer, opgehaalde context en uitvoer; een detectorfout mislukt standaard. Een lokale Rust detector vindt e-mailadressen, telefoonnummers, betaalkaarten, IBAN's, Amerikaanse SSN's en IP-adressen en kan deze observeren, vervangen, maskeren, pseudonimiseren of ontkennen.
Welke modelformaten ondersteunt OneVeer?
GGUF bestanden voor chatmodellen en encoders uit de BERT-familie (insluitingen, classificatie, herrangschikking), plus verpakte Whisper-, Piper- en Kokoro-modellen voor spraak. Modellen kunnen uit Hugging Face worden gehaald of in de modellenmap worden geplaatst.
Is OneVeer open source?
Nee. OneVeer is bedrijfseigen software van Onega, beschikbaar onder een commerciële licentie; de licentie-eigenaar is Onega. Het bouwt voort op llama.cpp, dat een MIT-licentie heeft. Vraag een walkthrough aan om het te evalueren.