pkg.sopackage field notes

brew / rang 218

Installer llama.cpp avec Homebrew

Consultez les chemins d'installation, exécutables, métadonnées et notes de sécurité de llama.cpp pour les workflows d'agents IA.

installation

Commandes d'installation supplémentaires

macOS

Homebrewvérifié · 100%
brew install llama.cpp

provider-native install command

aperçu

Résumé du paquet

LLM inference in C/C++

Commandes et alias

  • llama
  • llama-batched
  • llama-batched-bench
  • llama-bench
  • llama-cli
  • llama-completion
  • llama-debug
  • llama-debug-template-parser
  • llama-diffusion-cli
  • llama-embedding
  • llama-eval-callback
  • llama-finetune
  • llama-fit-params
  • llama-gen-docs
  • llama-gguf
  • llama-gguf-hash
  • llama-gguf-split
  • llama-idle
  • llama-imatrix
  • llama-lookahead
  • llama-lookup
  • llama-lookup-create
  • llama-lookup-merge
  • llama-lookup-stats
  • llama-mtmd-cli
  • llama-parallel
  • llama-passkey
  • llama-perplexity
  • llama-quantize
  • llama-results
  • llama-retrieval
  • llama-server

historique

Historique du projet et usages

llama.cpp is one of the defining packages of the local-LLM era: a C/C++ inference stack that made it practical to run quantized transformer models on laptops, desktops, servers, and small devices without a heavyweight Python runtime.

Historique du projet

The repository was created on GitHub on March 10, 2023, shortly after Meta's LLaMA model release changed the center of gravity for local language-model experimentation. The README states the project goal as LLM inference with minimal setup and strong performance across local and cloud hardware.

The project is closely tied to ggml. Its README describes llama.cpp as the main playground for developing new ggml features, and the implementation grew around plain C/C++, integer quantization, CPU backends, and hardware accelerators such as Metal, CUDA, Vulkan, SYCL, HIP, and related GPU paths.

As model support broadened beyond the original LLaMA family, llama.cpp became a runtime and tooling umbrella: converters, quantizers, benchmarking tools, embedding tools, an OpenAI-compatible server, multimodal support, and many model-family loaders are represented in the command set and documentation.

Historique d'adoption

Package adoption spread because llama.cpp lowered the cost of trying local inference: build from source, install from Homebrew, Nix, winget, conda-forge, Docker, or download release binaries, then run a model file or fetch one from Hugging Face-oriented workflows.

The README's bindings list shows the surrounding ecosystem that formed around the C/C++ core, including Python, Go, Node.js, Ruby, browser/Wasm, editor-completion plugins, and server clients. That ecosystem made llama.cpp both an end-user CLI and a library/runtime target for other packages.

Its high-frequency build-tag release pattern reflects active downstream pressure: package managers, bindings, model hubs, and local-AI applications all depend on fast propagation of backend, quantization, and model-format changes.

Modes d'utilisation

Users run llama-cli for local prompts, llama-server for an OpenAI-compatible HTTP API, llama-bench for performance testing, llama-quantize for smaller model files, and many auxiliary tools for embeddings, perplexity, retrieval, tokenization, and model-file manipulation.

The package is especially useful when a developer wants a self-contained inference engine: compile once, point it at a model, and choose a CPU/GPU backend without adopting a full ML framework stack.

Pourquoi les passionnés de paquets s'y intéressent

For package maintainers, llama.cpp is unusually dynamic: hardware backend flags, model-format transitions, CLI renames, bundled tools, and release cadence all matter. It turned local AI into something package managers had to treat like a fast-moving systems tool rather than a single Python application.

It is also a packaging bridge between model hubs and Unix tooling. The same project can be installed as a formula, used as a server daemon, linked by language bindings, wrapped by desktop apps, or embedded in another inference product.

Chronologie

  • 2023: ggml-org/llama.cpp repository created on March 10.
  • 2023: The project manifesto discussion documented goals and direction for the early community.
  • 2024: llama.cpp issue trackers began maintaining separate API changelogs for libllama and llama-server.
  • 2025: Multimodal support reached llama-server through the upstream pull request and documentation referenced from the README.
  • 2026: Homebrew, Nix, winget, conda-forge, Docker, and release binaries were documented installation paths in the upstream README.

Related projects

  • ggml is the closest related project, because llama.cpp is the main development playground for that tensor library.
  • Important downstream and adjacent projects include llama-cpp-python, node-llama-cpp, go-llama.cpp, wllama, llama.vscode, llama.vim, and applications that wrap llama-server's OpenAI-compatible API.

posture de sécurité

Aucune couverture d'outil protégé trouvée pour le moment

Aucun manifest local de gestion des secrets correspondant n'a été trouvé pour llama.cpp. Les métadonnées de paquet Nucleus restent publiées ici afin que la couverture future dispose d'une URL stable.

Comportement d'installation

  • Aucune métadonnée de bottle Homebrew n’a été enregistrée.

Revue recommandée

Avant une utilisation sans surveillance par un agent, vérifiez si l'outil lit des identifiants en clair, écrit un état distant, publie des artefacts ou lance des plugins.

exécutables

Exécutables installés

CommandeTypeExpositionNote
llamaexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-batchedexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-batched-benchexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-benchexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-cliexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-completionexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-debugexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-debug-template-parserexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-diffusion-cliexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-embeddingexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-eval-callbackexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-finetuneexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-fit-paramsexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-gen-docsexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-ggufexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-gguf-hashexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-gguf-splitexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-idleexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-imatrixexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-lookaheadexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-lookupexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-lookup-createexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-lookup-mergeexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-lookup-statsexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-mtmd-cliexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-parallelexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-passkeyexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-perplexityexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-quantizeexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-resultsexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-retrievalexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-serverexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-simpleexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-simple-chatexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-speculativeexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-speculative-simpleexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-template-analysisexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-tokenizeexécutableexécutable indexéDécouvert depuis l'index local des exécutables.
llama-ttsexécutableexécutable indexéDécouvert depuis l'index local des exécutables.

fraîcheur

Version et fraîcheur

Ces signaux séparent l'âge de génération de la page, l'activité du gestionnaire de paquets et la comparaison avec les versions amont. Un retard de version n'est signalé que lorsqu'une URL de preuve et des versions comparables sont présentes.

page générée2026-08-03
version du gestionnaire10210
gestionnaire mis à jour2026-07-31
données localesinconnu
amontnon disponible
dernière version détectéenon détecté
  • OKAucun avertissement de fraîcheur n'a été généré.

métadonnées d'installation

Métadonnées du paquet

Clé du paquetbrew:llama.cpp
Version10210
Gestionnaire de paquetsHomebrew
Page d'accueilhttps://llama.app
Dépôthttps://github.com/ggml-org/llama.cpp
Dernière mise à jour2026-07-31T19:04:02Z
Pulseupdated
Bouteillenon enregistré
Serviceaucun déclaré

piste source

Généré depuis les données du dépôt

Cette page est servie par av-web depuis l'artéfact SQLite privé des paquets généré par scripts/generate-pkg-sqlite.py.

Sources utilisées

  • Geiger risk classifier
  • Nucleus package database
  • curated package history
  • pkgdb category and tag curation