bashkit
Benches

Latest benchmark snapshot

Static aggregate generated from repository result artifacts. Use the linked files for raw measurements and full eval traces.

Latest reports

Open Markdown reports

Python startup

python3: CPython (wasm) vs Monty

Open report (2026-10-07)
MeasureCPythonMonty
First callfresh process, includes runtime load18.85 ms0.575 ms
Next callsame process, new interpreter state4.412 ms0.049 ms
Warm print(1)median per call in a long-lived session4.424 ms0.018 ms
Python startup history

CPython per run

RunFirst callWarm print(1)
2026-10-07import http.client: 461.12 ms18.85 ms4.424 ms
2026-10-06import timing not recorded21.896 ms6.312 ms
Runtime snapshot

Latest benchmark categories

Browse benchmark runs
CategoryCasesLast run
startupSmall commands where interpreter startup dominates runtime.40.016 msbash median: 4.769 ms
arithmeticInteger math, substitutions, and expression-heavy shell snippets.60.018 msbash median: 4.313 ms
stringsString expansion, pattern handling, and text manipulation.80.018 msbash median: 4.378 ms
variablesVariable assignment, lookup, expansion, and environment handling.80.019 msbash median: 4.096 ms
arraysIndexed array reads, writes, expansion, and iteration.60.019 msbash median: 4.064 ms
pipesPipeline construction, streaming, and command chaining.60.021 msbash median: 5.898 ms
subshellCommand substitution and nested shell execution paths.60.024 msbash median: 5.484 ms
controlConditionals, loops, case statements, and branching scripts.90.025 msbash median: 3.812 ms
Eval pressure

Lowest eval categories

Browse eval runs
Latest LLM eval93%54/58 tasks
CategoryPassedPass rate
system_info1/250%tasks passed
file_operations3/466.7%tasks passed
scripting5/768.6%tasks passed
json_processing8/8100%tasks passed
data_transformation6/6100%tasks passed
complex_tasks6/6100%tasks passed
text_processing6/6100%tasks passed
pipelines5/5100%tasks passed