Pytania
Często zadawane pytania dotyczące OneVeer.
Krótkie odpowiedzi na pytania zadawane przez ewaluatorów jako pierwsze. Te same odpowiedzi publikowane są w danych strukturalnych strony.
Co to jest brama LLM?
Brama LLM (nazywana także bramą AI lub bramą wnioskowania) to serwer pomiędzy aplikacjami i modelami. Aplikacje wywołują jeden punkt końcowy; brama je uwierzytelnia, wybiera model lub dostawcę, stosuje politykę i rejestruje, co się stało. OneVeer to bramka LLM, która w tym samym procesie uruchamia również same modele na Twoim sprzęcie.
Czy OneVeer jest alternatywą dla vLLM?
Do innej pracy. vLLM to system obsługujący język Python zbudowany z myślą o przepustowości centrów danych w klastrach GPU. OneVeer celuje w pojedynczy węzeł, który kontrolujesz: jeden natywny serwer, który łączy silnik wnioskowania llama.cpp (CPU, Vulkan, CUDA) z bramą, silnikiem zasad i routingiem dostawcy. Wybierz vLLM, aby obsługiwać w skali klastra; wybierz OneVeer, jeśli wymagana jest zarządzana brama działająca tam, gdzie znajdują się Twoje dane.
Czy OneVeer jest alternatywą dla Ollama?
Ollama to lokalny model biegacz skierowany do indywidualnych deweloperów. OneVeer został stworzony, aby udostępniać lokalne modele aplikacjom i zespołom: klucze aplikacji z dotacjami i limitami modeli, opublikowany katalog modeli, routing do dostawców usług w chmurze z rezerwami i budżetami, ochrona modeli przed natychmiastowym wstrzyknięciem, redakcja danych osobowych, zatrzymanie awaryjne, metryki Prometheus i eksport OpenTelemetry. Obydwa używają stosu llama.cpp/ggml do wnioskowania lokalnego.
Czy OneVeer działa z pakietami SDK OpenAI i Anthropic?
Tak. OneVeer obsługuje czat, uzupełnienia, osadzania i modele zgodne z OpenAI, a także punkt końcowy wiadomości Anthropic. Wskaż podstawowy adres URL zestawu SDK na OneVeer i zachowaj kod klienta. Claude Code, Cursor, Codex CLI, LangChain, n8n, LibreChat i dowolne narzędzie kompatybilne z OpenAI działają w ten sam sposób.
Na jakim sprzęcie działa OneVeer?
Procesor, procesory graficzne NVIDIA, AMD i Intel do Vulkan (kompilacja domyślna) oraz procesory graficzne NVIDIA do CUDA. Windows 11 to sprawdzona platforma; Kompilacje systemów Linux i macOS nie są jeszcze certyfikowane. OneVeer dopasowuje każdy model do wolnej pamięci i umieszcza go na procesorze graficznym, na różnych procesorach graficznych, jako hybrydę MoE z ekspertami w dziedzinie pamięci RAM lub na procesorze.
Czy dane opuszczają moją maszynę?
Tylko za pośrednictwem skonfigurowanej przez Ciebie trasy dostawcy. Modele lokalne działają w procesie OneVeer. Przełącznik główny lub nagłówek żądania przypina żądania do modeli lokalnych. Eksport OpenTelemetry jest domyślnie wyłączony i nigdy nie obejmuje monitów, uzupełnień, ładunków narzędzi ani kluczy.
Jak OneVeer radzi sobie z natychmiastowym wstrzykiwaniem i danymi osobowymi?
Modele Guard (Prompt Guard 2, ProtectAI DeBERTa v3, Llama Guard 3 i Granite Guardian HAP) sprawdzają dane wejściowe, uzyskany kontekst i dane wyjściowe; awaria czujki domyślnie jest zamknięta. Lokalny detektor Rust wyszukuje adresy e-mail, numery telefonów, karty płatnicze, numery IBAN, amerykańskie numery SSN i adresy IP i może je obserwować, zastępować, maskować, pseudonimizować lub odrzucać.
Jakie formaty modeli obsługuje OneVeer?
Pliki GGUF dla modeli czatów i koderów z rodziny BERT (osadzanie, klasyfikacja, reranking), a także spakowane modele mowy Whisper, Piper i Kokoro. Modele można pobrać z Hugging Face lub upuścić do folderu modeli.
Czy OneVeer jest oprogramowaniem typu open source?
Nie. OneVeer to oprogramowanie prawnie zastrzeżone firmy Onega, dostępne na licencji komercyjnej; właścicielem licencji jest Onega. Opiera się na llama.cpp, który jest licencjonowany przez MIT. Poproś o instrukcję, aby ją ocenić.