Sorular
OneVeer hakkında sık sorulan sorular.
Değerlendiricilerin öncelikle sorduğu sorulara kısa cevaplar. Aynı cevaplar sayfanın yapılandırılmış verilerinde de yayınlanır.
LLM ağ geçidi nedir?
LLM ağ geçidi (AI ağ geçidi veya çıkarım ağ geçidi olarak da bilinir), uygulamalar ve modeller arasında bir sunucudur. Uygulamalar bir uç noktayı çağırır; ağ geçidi bunların kimliğini doğrular, modeli veya sağlayıcıyı seçer, politikayı uygular ve olanları kaydeder. OneVeer, aynı süreçte modelleri kendi donanımınızda da çalıştıran bir LLM ağ geçididir.
OneVeer, vLLM'ye bir alternatif midir?
Farklı bir iş için. vLLM, GPU kümelerinde veri merkezi verimi için oluşturulmuş bir Python hizmet sistemidir. OneVeer, kontrol ettiğiniz tek bir düğümü hedefler: llama.cpp çıkarım motorunu (CPU, Vulkan, CUDA) bir ağ geçidi, bir politika motoru ve sağlayıcı yönlendirmesi ile birleştiren bir yerel sunucu. Küme ölçeğinde sunum için vLLM'yi seçin; Gereksinim, verilerinizin bulunduğu yerde çalışan yönetilen bir ağ geçidi olduğunda OneVeer'yi seçin.
OneVeer Ollama'ya bir alternatif midir?
Ollama, bireysel geliştiricilere yönelik yerel bir model koşucusudur. OneVeer, yerel modelleri uygulamaların ve ekiplerin önüne koymak için tasarlanmıştır: model hibeleri ve limitleri içeren uygulama anahtarları, yayınlanmış bir model kataloğu, geri dönüş ve bütçelerle bulut sağlayıcılarına yönlendirme, modelleri hızlı enjeksiyona karşı koruma, PII düzenlemesi, acil durdurma, Prometheus ölçümleri ve OpenTelemetry dışa aktarımı. Her ikisi de yerel çıkarım için llama.cpp/ggml yığınını kullanır.
OneVeer, OpenAI ve Anthropic SDK'larıyla çalışır mı?
Evet. OneVeer, OpenAI uyumlu sohbet, tamamlamalar, yerleştirmeler ve model uç noktaları ile Anthropic mesajları uç noktasını sunar. SDK'nın temel URL'sini OneVeer'ye yönlendirin ve istemci kodunu saklayın. Claude Code, Cursor, Codex CLI, LangChain, n8n, LibreChat ve OpenAI uyumlu herhangi bir araç aynı şekilde çalışır.
OneVeer hangi donanımda çalışır?
Vulkan (varsayılan yapı) aracılığıyla CPU, NVIDIA, AMD ve Intel GPU'lar ve CUDA aracılığıyla NVIDIA GPU'lar. Windows 11 doğrulanmış platformdur; Linux ve macOS sürümleri henüz sertifikalı değildir. OneVeer, her modeli boş belleğe göre boyutlandırır ve onu bir GPU'ya, GPU'lar arasında, RAM uzmanlarıyla bir MoE hibriti olarak veya CPU'ya yerleştirir.
Veriler makinemden çıkıyor mu?
Yalnızca yapılandırdığınız sağlayıcı rotası aracılığıyla. Yerel modeller OneVeer süreci içinde çalışır. Yerel modellere yönelik bir ana anahtar veya istek başına başlık pinleri istekleri. OpenTelemetry dışa aktarımı varsayılan olarak kapalıdır ve hiçbir zaman istemleri, tamamlamaları, araç yüklerini veya anahtarları içermez.
OneVeer, anında eklemeyi ve kişisel verileri nasıl işler?
Koruma modelleri (Prompt Guard 2, ProtectAI DeBERTa v3, Llama Guard 3 ve Granite Guardian HAP) girdiyi, alınan bağlamı ve çıktıyı denetler; bir dedektör arızası varsayılan olarak kapatılmaz. Yerel bir Rust algılayıcı, e-posta adreslerini, telefon numaralarını, ödeme kartlarını, IBAN'ları, ABD SSN'lerini ve IP adreslerini bulur ve gözlemleyebilir, değiştirebilir, maskeleyebilir, takma ad verebilir veya reddedebilir.
OneVeer hangi model formatlarını destekliyor?
Sohbet modelleri ve BERT ailesi kodlayıcılar (yerleştirmeler, sınıflandırma, yeniden sıralama) için GGUF dosyaları ve ayrıca konuşma için paketlenmiş Whisper, Piper ve Kokoro modelleri. Modeller Hugging Face'ten alınabilir veya modeller klasörüne bırakılabilir.
OneVeer açık kaynak mı?
Hayır. OneVeer, Onega'nin ticari lisans kapsamında sunulan tescilli yazılımıdır; lisans sahibi Onega'dir. MIT lisanslı llama.cpp üzerine kurulmuştur. Değerlendirmek için bir izlenecek yol isteyin.