Android / llama.cpp / GGUF

LLM AI Server with llama.cpp

LLM AI Server with llama.cpp は、Android 端末上で GGUF モデルを読み込み、推論設定・プロンプトテンプレート・共有 MCP / Function Definitions 設定・ログ確認・Ollama/OpenAI 互換 API と同梱 WebUI の公開までを一つのアプリで扱えるローカル LLM 検証ツールです。

  • モデル URL からのダウンロードと、端末内 .gguf ファイルの取り込みに対応します。
  • 生成パラメータ、Think 設定、カスタム chat template、共有 MCP 設定、Function Definitions JSON を組み合わせて運用できます。
  • 必要に応じて端末内で Ollama/OpenAI 互換 API と WebUI を同じポートで起動し、/api/chat/v1/chat/completions を利用できます。

スクリーンショット

LLM AI Server with llama.cpp のメイン画面
メイン画面。ステータスヘッダー(速度・温度・バックエンド)、API/WebUI 制御、ダイレクト実行、処理ログをまとめて確認できます。
LLM AI Server with llama.cpp の設定画面
設定画面。モデル URL / ローカル GGUF 取り込み、GPU バックエンド選択、mmproj 設定、推論パラメータを調整できます。
LLM AI Server with llama.cpp のテンプレート設定
テンプレート・API・MCP・表示言語・ログ設定。System Prompt、custom chat template、Function Definitions JSON もここで管理します。

主な特徴

運用メモ