在您的機器上完全運行尖端 AI。無需 API 金鑰、遙測或限制。擁有您的模型和對話資料。

運行 llama serve,安裝 pi-llama 插件並啟動 Pi。它將自動發現您的本地模型。無需配置,無需 API 金鑰。檔案保留在您的機器上,請求永不離開。

從您的筆記型電腦到叢集,llama.cpp 運行在您擁有的任何設備上。每個 GPU 和 CPU 都有相同的二進位檔、相同的模型、相同的客製化核心。

阿里巴巴的下一代原生多模態推理模型。密集型和 MoE 變體在編碼和視覺任務上可與體積大許多的模型媲美。

Google 最強大的開放模型,基於 Gemini 3 技術。支援多模態推理、代理工作流程和 140 多種語言。

OpenAI 自 GPT-2 以來首批開放權重模型。專為推理、代理任務和開發者使用而建,具備函數調用和工具使用功能。

Google 基於 Gemini 技術的多模態模型。支援 140 多種語言、視覺和文本任務,最高支援 128K 上下文,適用於邊緣到雲端的部署。