Fragen
Häufig nach OneVeer gefragt.
Kurze Antworten auf die Fragen, die die Bewerter zuerst stellen. Die gleichen Antworten werden in den strukturierten Daten der Seite veröffentlicht.
Was ist ein LLM-Gateway?
Ein LLM-Gateway (auch AI-Gateway oder Inferenz-Gateway genannt) ist ein Server zwischen Anwendungen und Modellen. Anwendungen rufen einen Endpunkt auf; Das Gateway authentifiziert sie, wählt das Modell oder den Anbieter aus, wendet Richtlinien an und zeichnet auf, was passiert ist. OneVeer ist ein LLM-Gateway, das im selben Prozess auch die Modelle selbst auf Ihrer eigenen Hardware ausführt.
Ist OneVeer eine Alternative zu vLLM?
Für einen anderen Job. vLLM ist ein Python-Bereitstellungssystem, das für den Rechenzentrumsdurchsatz auf GPU-Clustern entwickelt wurde. OneVeer zielt auf einen einzelnen Knoten ab, den Sie steuern: einen nativen Server, der eine llama.cpp-Inferenz-Engine (CPU, Vulkan, CUDA) mit einem Gateway, einer Richtlinien-Engine und Provider-Routing kombiniert. Wählen Sie vLLM für die Bereitstellung im Clustermaßstab. Wählen Sie OneVeer, wenn die Anforderung ein verwaltetes Gateway ist, das dort ausgeführt wird, wo Ihre Daten gespeichert sind.
Ist OneVeer eine Alternative zu Ollama?
Ollama ist ein lokaler Modellläufer, der sich an einzelne Entwickler richtet. OneVeer wurde entwickelt, um lokale Modelle vor Anwendungen und Teams zu stellen: Anwendungsschlüssel mit Modellzuweisungen und -beschränkungen, ein veröffentlichter Modellkatalog, Weiterleitung an Cloud-Anbieter mit Fallback und Budgets, Schutz von Modellen vor sofortiger Injektion, PII-Redaktion, ein Notstopp, Prometheus-Metriken und OpenTelemetry-Export. Beide verwenden den llama.cpp/ggml-Stack für die lokale Inferenz.
Funktioniert OneVeer mit den SDKs OpenAI und Anthropic?
Ja. OneVeer bedient OpenAI-kompatible Chat-, Vervollständigungs-, Einbettungs- und Modellendpunkte sowie den Nachrichtenendpunkt Anthropic. Richten Sie die Basis-URL des SDK auf OneVeer und behalten Sie den Client-Code. Claude Code, Cursor, Codex CLI, LangChain, n8n, LibreChat und jedes OpenAI-kompatible Tool funktionieren auf die gleiche Weise.
Auf welcher Hardware läuft OneVeer?
CPU, NVIDIA-, AMD- und Intel-GPUs über Vulkan (Standard-Build) und NVIDIA-GPUs über CUDA. Windows 11 ist die validierte Plattform; Linux- und macOS-Builds sind noch nicht zertifiziert. OneVeer dimensioniert jedes Modell anhand des freien Speichers und platziert es auf einer GPU, auf mehreren GPUs, als MoE-Hybrid mit Experten für RAM oder auf der CPU.
Verlassen Daten meinen Computer?
Nur über eine von Ihnen konfigurierte Anbieterroute. Lokale Modelle werden im OneVeer-Prozess ausgeführt. Ein Hauptschalter oder ein Per-Request-Header pinnt Anfragen an lokale Modelle. Der OpenTelemetry-Export ist standardmäßig deaktiviert und enthält niemals Eingabeaufforderungen, Vervollständigungen, Tool-Payloads oder Schlüssel.
Wie geht OneVeer mit sofortiger Injektion und personenbezogenen Daten um?
Guard-Modelle (Prompt Guard 2, ProtectAI DeBERTa v3, Llama Guard 3 und Granite Guardian HAP) prüfen die Eingabe, den abgerufenen Kontext und die Ausgabe; Ein Detektorfehler schlägt standardmäßig fehl. Ein lokaler Rust-Detektor findet E-Mail-Adressen, Telefonnummern, Zahlungskarten, IBANs, US-SSNs und IP-Adressen und kann beobachten, ersetzen, maskieren, pseudonymisieren oder ablehnen.
Welche Modellformate unterstützt OneVeer?
GGUF-Dateien für Chat-Modelle und Encoder der BERT-Familie (Einbettungen, Klassifizierung, Neuranking) sowie gepackte Whisper-, Piper- und Kokoro-Modelle für Sprache. Modelle können aus Hugging Face gezogen oder im Modellordner abgelegt werden.
Ist OneVeer Open Source?
Nein. OneVeer ist proprietäre Software von Onega, verfügbar unter einer kommerziellen Lizenz; Der Lizenzinhaber ist Onega. Es basiert auf llama.cpp, das MIT-lizenziert ist. Fordern Sie eine Komplettlösung an, um es zu bewerten.