llama.cpp Server を Mac で
Lightweight local LLM server (OpenAI-compatible) · AI / LLMs
llama.cpp is the lean C/C++ inference engine for GGUF models, with first-class Apple Silicon (Metal) support. brew install llama.cpp, then run llama-server -m model.gguf to serve an OpenAI-compatible API on :8080 (/v1/chat/completions) — point the AI Administrator, LibreChat or OpenCode at it. Add it as a provider in AI Administrator (llama.cpp Server). Download GGUF models from Hugging Face.
llama.cpp Server を FrontierStack で使う
FrontierStack は llama.cpp Server を AI / LLMs カタログに収録しています。ひとつの場所でインストール/接続し、状態・ポート・証明書を監視、ファイアウォールとマルウェア監査で保護し、バックアップできます。
すべてをひとつの Mac アプリで。
FrontierStack は、ローカルでもフリート全体でも、スタック全体のインストール・監視・保護をひとつのネイティブ macOS アプリで行います。
FrontierStack をダウンロード