Native llama.cpp orchestration for quantized LLM evaluation, drift analysis, and reproducible model comparison.
python performance-analysis quantization model-evaluation model-comparison pydantic apple-silicon typer-cli llm llmops llama-cpp local-ai gguf reproducible-ai inference-evaluation quantization-drift sementic-preservation native-inference
-
Updated
May 31, 2026 - Python