{ "artifact_sha256": { "llama-cpp-near-lossless-quality": "e842fdc35d7f00fda95a54e1b51731ba1d196aea45065cc9f46925fdc1d6f862", "llama-cpp-quantized-performance-fit": "a88e3f570e2efeaf06b50df9859db2c70d8646aa3a2c94a14e14d5797a2921a5", "transformers-safetensors-reference": "e596e9d6205fdc9177569cccd7f8b471b058f66e3630c8e4326d5aad52bd18b6" }, "backend_detail": { "llama-cpp-near-lossless-quality": "version: 9991 (e920c523) | built with GNU 15.2.1 for Linux x86_64; binary sha256 fd8fe612970f23e447f2e717cfa51665be06b8d7315ba60556e010f6bca510dd; threads 16; parallel slots 4; ctx/slot 512; gpu layers 0", "llama-cpp-quantized-performance-fit": "version: 9991 (e920c523) | built with GNU 15.2.1 for Linux x86_64; binary sha256 fd8fe612970f23e447f2e717cfa51665be06b8d7315ba60556e010f6bca510dd; threads 16; parallel slots 4; ctx/slot 512; gpu layers 0", "transformers-safetensors-reference": "torch 2.10.0+rocm7.13.0a20260513; dtype bfloat16; device cpu; intra-op threads 16" }, "evidence_class": "local-real", "host": { "accelerator_name": "Radeon 8060S Graphics", "accelerator_runtime": "7.13.26183", "benchmark_lane": "cpu-controlled-baseline", "converter_sha256": "c819f18fb22927b49fabc3b35d1c9e21ee638b3817eccd1bd4efbcc7116eeb4d", "cpu_count": 32, "cuda_available": true, "hostname": "fedora", "llama_cpp_commit": "e920c523e3b8a0163fe498af5bf90df35ff51d25", "llama_cpp_version": "9991", "llama_server_identities": { "/run/media/popov/d/DEV/llamacpp/llama.cpp/build/bin/llama-server": { "sha256": "fd8fe612970f23e447f2e717cfa51665be06b8d7315ba60556e010f6bca510dd", "version": "version: 9991 (e920c523) | built with GNU 15.2.1 for Linux x86_64" } }, "llama_server_sha256": "fd8fe612970f23e447f2e717cfa51665be06b8d7315ba60556e010f6bca510dd", "platform": "Linux-7.0.14-101.fc43.x86_64-x86_64-with-glibc2.42", "python": "3.12.13", "quantizer_sha256": "bd0cc8c7be6d48aad4755b31062e0e59a887cbadd43dbb8771853d5858bb198f", "torch_version": "2.10.0+rocm7.13.0a20260513", "transformers_version": "5.13.0" }, "model_id": "Qwen/Qwen2.5-0.5B-Instruct", "model_revision": "7ae557604adf67be50417f59c2c2f167def9a775", "plan_sha256": "efe24690a9a7164bac6ab3fd0a6b22f078fc08aaefcfb96210ddf154e6050570", "provenance": { "completed_at": "2026-07-22T05:52:30.445799Z", "config_sha256": "00b2cce3e2f281bdf92fc5304ba5cac915a178ffccd3b9a25995ce39c00b90d3", "producer": "meshnet_node.recipe_drivers.run_configured_benchmark/v1", "run_id": "59b12968-c5d0-4391-90f4-0cd2aff77b21", "schema_version": 1, "signature": "aExtG1Y0fWFaqlKEtUOOpXZrganVAxbLvpov2WVgm19eNJ50VheeI7CuRhlWx4SJX9OFto2WuLaVPhjwSA88Cw==", "signature_algorithm": "ed25519", "signer_public_key_sha256": "8baca8742d9b3ed0c3fc54929c23f75ec8c1c739900aaf5334780d598ffa84de", "started_at": "2026-07-22T05:51:36.511891Z" }, "recipe_runtime": { "llama-cpp-near-lossless-quality": { "device": "cpu", "runtime": "llama.cpp-9991-e920c523", "weight_format": "gguf", "weight_quantization": "bfloat16" }, "llama-cpp-quantized-performance-fit": { "device": "cpu", "runtime": "llama.cpp-9991-e920c523", "weight_format": "gguf", "weight_quantization": "Q4_K_M" }, "transformers-safetensors-reference": { "device": "cpu", "runtime": "transformers-5.13.0", "weight_format": "safetensors", "weight_quantization": "bfloat16" } }, "recipes": { "llama-cpp-near-lossless-quality": { "artifact_bytes": 994156448, "available": true, "concurrency": { "1": { "aggregate_decode_tokens_per_sec": 89.2873, "decode_tokens_per_sec": 102.5344, "failures": 0, "latency_p50_ms": 316.647, "latency_p95_ms": 374.8515, "peak_rss_bytes": 1110106112, "peak_vram_bytes": 0, "prefill_tokens_per_sec": 1740.0213, "ttft_p50_ms": 15.067, "ttft_p95_ms": 65.191 }, "4": { "aggregate_decode_tokens_per_sec": 218.1128, "decode_tokens_per_sec": 80.0623, "failures": 0, "latency_p50_ms": 403.9781, "latency_p95_ms": 767.6557, "peak_rss_bytes": 1139265536, "peak_vram_bytes": 0, "prefill_tokens_per_sec": 1064.6179, "ttft_p50_ms": 36.611, "ttft_p95_ms": 178.801 } }, "device": "cpu", "lane": "quality" }, "llama-cpp-quantized-performance-fit": { "artifact_bytes": 397807520, "available": true, "concurrency": { "1": { "aggregate_decode_tokens_per_sec": 149.8675, "decode_tokens_per_sec": 213.1452, "failures": 0, "latency_p50_ms": 161.7164, "latency_p95_ms": 282.5491, "peak_rss_bytes": 541663232, "peak_vram_bytes": 0, "prefill_tokens_per_sec": 1181.0842, "ttft_p50_ms": 17.252, "ttft_p95_ms": 130.529 }, "4": { "aggregate_decode_tokens_per_sec": 235.6963, "decode_tokens_per_sec": 94.7604, "failures": 0, "latency_p50_ms": 373.7211, "latency_p95_ms": 759.3151, "peak_rss_bytes": 571027456, "peak_vram_bytes": 0, "prefill_tokens_per_sec": 567.7335, "ttft_p50_ms": 42.086, "ttft_p95_ms": 312.645 } }, "device": "cpu", "lane": "performance-fit" }, "transformers-safetensors-reference": { "artifact_bytes": 999586347, "available": true, "concurrency": { "1": { "aggregate_decode_tokens_per_sec": 44.4625, "decode_tokens_per_sec": 50.8327, "failures": 0, "latency_p50_ms": 701.9146, "latency_p95_ms": 776.2706, "peak_rss_bytes": 1933221888, "peak_vram_bytes": 0, "prefill_tokens_per_sec": 699.7553, "ttft_p50_ms": 32.8569, "ttft_p95_ms": 173.7161 }, "4": { "aggregate_decode_tokens_per_sec": 48.849, "decode_tokens_per_sec": 13.4779, "failures": 0, "latency_p50_ms": 2503.1601, "latency_p95_ms": 2600.6307, "peak_rss_bytes": 2170908672, "peak_vram_bytes": 0, "prefill_tokens_per_sec": 264.5822, "ttft_p50_ms": 95.7502, "ttft_p95_ms": 425.4973 } }, "device": "cpu", "lane": "quality" } }, "reference_recipe_id": "transformers-safetensors-reference" }