Kysymyksiä
Usein kysytty aiheesta OneVeer.
Lyhyet vastaukset arvioijien ensin esittämiin kysymyksiin. Samat vastaukset julkaistaan sivun strukturoidussa datassa.
Mikä on LLM-yhdyskäytävä?
LLM-yhdyskäytävä (kutsutaan myös AI-yhdyskäytäväksi tai päättelyyhdyskäytäväksi) on palvelin sovellusten ja mallien välillä. Sovellukset kutsuvat yhtä päätepistettä; yhdyskäytävä todentaa ne, valitsee mallin tai toimittajan, soveltaa käytäntöä ja kirjaa tapahtuneen. OneVeer on LLM-yhdyskäytävä, joka myös ajaa itse malleja omalla laitteistollasi samassa prosessissa.
Onko OneVeer vaihtoehto numerolle vLLM?
Eri työhön. vLLM on Python-palvelujärjestelmä, joka on rakennettu datakeskuksen suorituskyvylle GPU-klustereissa. OneVeer kohdistuu yhteen ohjaamaan solmuun: yhteen natiivipalvelimeen, joka yhdistää llama.cpp päättelymoottorin (CPU, Vulkan, CUDA) yhdyskäytävään, käytäntömoottoriin ja palveluntarjoajan reititykseen. Valitse vLLM klusterimittakaavaista käyttöä varten; valitse OneVeer, kun vaatimus on säädelty yhdyskäytävä, joka toimii siellä, missä tietosi ovat.
Onko OneVeer vaihtoehto Ollamalle?
Ollama on paikallinen mallijuoksija, joka on suunnattu yksittäisille kehittäjille. OneVeer on suunniteltu tuomaan paikallisia malleja sovellusten ja työryhmien eteen: sovellusavaimet, joissa on malliapurahoja ja -rajoituksia, julkaistu malliluettelo, reititys pilvipalveluntarjoajille vara- ja budjeteilla, suojata malleja nopealta lisäyksestä, henkilökohtaisten tunnistetietojen muokkaus, hätäpysäytys, Prometheus-mittarit ja OpenTelemetry-vienti. Molemmat käyttävät llama.cpp/ggml-pinoa paikallisiin päätelmiin.
Toimiiko OneVeer SDK:iden OpenAI ja Anthropic kanssa?
Kyllä. OneVeer palvelee OpenAI-yhteensopivaa chattia, täydennyksiä, upotuksia ja mallien päätepisteitä ja Anthropic-viestien päätepistettä. Osoita SDK:n perus-URL-osoite OneVeer ja säilytä asiakaskoodi. Claude Code, Cursor, Codex CLI, LangChain, n8n, LibreChat ja kaikki OpenAI-yhteensopivat työkalut toimivat samalla tavalla.
Millä laitteistolla OneVeer toimii?
CPU-, NVIDIA-, AMD- ja Intel-grafiikkasuorittimet numeroon Vulkan asti (oletusrakenne) ja NVIDIA-grafiikkasuorittimet numeroon CUDA asti. Windows 11 on validoitu alusta; Linux- ja macOS-versiot eivät ole vielä sertifioituja. OneVeer kokoaa kunkin mallin vapaata muistia vastaan ja sijoittaa sen GPU:lle, GPU:ille, MoE-hybridinä RAM-asiantuntijoiden kanssa tai suorittimeen.
Poistuuko data koneeltani?
Vain määrittämäsi palveluntarjoajan reitin kautta. Paikalliset mallit toimivat OneVeer-prosessin sisällä. Pääkytkin tai pyyntökohtainen otsikko kiinnittää pyynnöt paikallisiin malleihin. OpenTelemetry-vienti on oletuksena pois päältä, eikä se koskaan sisällä kehotteita, täydennyksiä, työkalujen hyötykuormia tai avaimia.
Miten OneVeer käsittelee nopeita pistos- ja henkilötietoja?
Valvontamallit (Prompt Guard 2, ProtectAI DeBERTa v3, Llama Guard 3 ja Granite Guardian HAP) tarkastavat syötteen, haetun kontekstin ja tulosteen; ilmaisimen vika sulkeutuu oletusarvoisesti. Paikallinen Rust-ilmaisin löytää sähköpostiosoitteet, puhelinnumerot, maksukortit, IBAN-tunnukset, US SSN:t ja IP-osoitteet ja voi tarkkailla, korvata, peittää, pseudonyymisoida tai kieltää.
Mitä mallimuotoja OneVeer tukee?
GGUF tiedostot chat-malleille ja BERT-perheen koodereille (upotukset, luokittelu, uudelleensijoitus) sekä pakatut Whisper-, Piper- ja Kokoro-mallit puhetta varten. Mallit voidaan vetää Hugging Facesta tai pudottaa mallit-kansioon.
Onko OneVeer avoin lähdekoodi?
Nro OneVeer on valmistajan Onega omistama ohjelmisto, joka on saatavilla kaupallisella lisenssillä; lisenssin omistaja on Onega. Se perustuu tiedostoon llama.cpp, joka on MIT-lisensoitu. Pyydä esittelyä sen arvioimiseksi.