tests/counter/benchmark.lua

*e3723e1fSApple OSS Distributions#!/usr/local/bin/recon
*e3723e1fSApple OSS Distributionsrequire 'strict'
*e3723e1fSApple OSS Distributions
*e3723e1fSApple OSS Distributionslocal benchrun = require 'benchrun'
*e3723e1fSApple OSS Distributionslocal perfdata = require 'perfdata'
*e3723e1fSApple OSS Distributionslocal sysctl = require 'sysctl'
*e3723e1fSApple OSS Distributionslocal csv = require 'csv'
*e3723e1fSApple OSS Distributions
*e3723e1fSApple OSS Distributionslocal kDefaultNumWrites = 10000000000
*e3723e1fSApple OSS Distributions
*e3723e1fSApple OSS Distributionslocal benchmark = benchrun.new {
*e3723e1fSApple OSS Distributions    name = 'xnu.per_cpu_counter',
*e3723e1fSApple OSS Distributions    version = 1,
*e3723e1fSApple OSS Distributions    arg = arg,
*e3723e1fSApple OSS Distributions    modify_argparser = function(parser)
*e3723e1fSApple OSS Distributions        parser:argument{
*e3723e1fSApple OSS Distributions          name = 'path',
*e3723e1fSApple OSS Distributions          description = 'Path to benchmark binary'
*e3723e1fSApple OSS Distributions        }
*e3723e1fSApple OSS Distributions        parser:option{
*e3723e1fSApple OSS Distributions            name = '--cpu-workers',
*e3723e1fSApple OSS Distributions            description = 'Number of cpu workers'
*e3723e1fSApple OSS Distributions        }
*e3723e1fSApple OSS Distributions        parser:flag{
*e3723e1fSApple OSS Distributions          name = '--through-max-workers',
*e3723e1fSApple OSS Distributions          description = 'Run benchmark for [1..n] cpu workers'
*e3723e1fSApple OSS Distributions        }
*e3723e1fSApple OSS Distributions        parser:flag{
*e3723e1fSApple OSS Distributions          name = '--through-max-workers-fast',
*e3723e1fSApple OSS Distributions          description = 'Run benchmark for [1..2] and each power of four value in [4..n] cpu workers'
*e3723e1fSApple OSS Distributions        }
*e3723e1fSApple OSS Distributions        parser:option {
*e3723e1fSApple OSS Distributions            name = "--num-writes",
*e3723e1fSApple OSS Distributions            description = "number of writes",
*e3723e1fSApple OSS Distributions            default = kDefaultNumWrites
*e3723e1fSApple OSS Distributions        }
*e3723e1fSApple OSS Distributions        parser:option{
*e3723e1fSApple OSS Distributions            name = '--variant',
*e3723e1fSApple OSS Distributions            description = 'Which benchmark variant to run (scalable, atomic, or racy)',
*e3723e1fSApple OSS Distributions            default = 'scalable',
*e3723e1fSApple OSS Distributions            choices = {"scalable", "atomic", "racy"}
*e3723e1fSApple OSS Distributions        }
*e3723e1fSApple OSS Distributions    end
*e3723e1fSApple OSS Distributions}
*e3723e1fSApple OSS Distributions
*e3723e1fSApple OSS Distributionsassert(benchmark.opt.path, "No path supplied for fault throughput binary")
*e3723e1fSApple OSS Distributions
*e3723e1fSApple OSS Distributionslocal ncpus, err = sysctl('hw.logicalcpu_max')
*e3723e1fSApple OSS Distributionsassert(ncpus > 0, 'invalid number of logical cpus')
*e3723e1fSApple OSS Distributionslocal cpu_workers = tonumber(benchmark.opt.cpu_workers) or ncpus
*e3723e1fSApple OSS Distributions
*e3723e1fSApple OSS Distributionslocal writes_per_second = perfdata.unit.custom('writes/sec')
*e3723e1fSApple OSS Distributionslocal tests = {}
*e3723e1fSApple OSS Distributions
*e3723e1fSApple OSS Distributionsfunction QueueTest(num_cores)
*e3723e1fSApple OSS Distributions    table.insert(tests, {
*e3723e1fSApple OSS Distributions        path = benchmark.opt.path,
*e3723e1fSApple OSS Distributions        num_cores = num_cores,
*e3723e1fSApple OSS Distributions    })
*e3723e1fSApple OSS Distributionsend
*e3723e1fSApple OSS Distributions
*e3723e1fSApple OSS Distributionsif benchmark.opt.through_max_workers then
*e3723e1fSApple OSS Distributions    for i = 1, cpu_workers do
*e3723e1fSApple OSS Distributions        QueueTest(i)
*e3723e1fSApple OSS Distributions    end
*e3723e1fSApple OSS Distributionselseif benchmark.opt.through_max_workers_fast then
*e3723e1fSApple OSS Distributions    local i = 1
*e3723e1fSApple OSS Distributions    while i <= cpu_workers do
*e3723e1fSApple OSS Distributions        QueueTest(i)
*e3723e1fSApple OSS Distributions        -- Always do a run with two threads to see what the first part of
*e3723e1fSApple OSS Distributions        -- the scaling curve looks like
*e3723e1fSApple OSS Distributions        -- (and to measure perf on dual core systems).
*e3723e1fSApple OSS Distributions        if i == 1 and cpu_workers >= 2 then
*e3723e1fSApple OSS Distributions            QueueTest(i + 1)
*e3723e1fSApple OSS Distributions        end
*e3723e1fSApple OSS Distributions        i = i * 4
*e3723e1fSApple OSS Distributions    end
*e3723e1fSApple OSS Distributionselse
*e3723e1fSApple OSS Distributions    QueueTest(cpu_workers)
*e3723e1fSApple OSS Distributionsend
*e3723e1fSApple OSS Distributions
*e3723e1fSApple OSS Distributionsfor _, test in ipairs(tests) do
*e3723e1fSApple OSS Distributions    local args = {test.path, benchmark.opt.variant, benchmark.opt.num_writes, test.num_cores,
*e3723e1fSApple OSS Distributions                     echo = true}
*e3723e1fSApple OSS Distributions    for out in benchmark:run(args) do
*e3723e1fSApple OSS Distributions        local result = out:match("-----Results-----\n(.*)")
*e3723e1fSApple OSS Distributions        benchmark:assert(result, "Unable to find result data in output")
*e3723e1fSApple OSS Distributions        local data = csv.openstring(result, {header = true})
*e3723e1fSApple OSS Distributions        for field in data:lines() do
*e3723e1fSApple OSS Distributions            for k, v in pairs(field) do
*e3723e1fSApple OSS Distributions                local unit = writes_per_second
*e3723e1fSApple OSS Distributions                local larger_better = true
*e3723e1fSApple OSS Distributions                if k == "loss" then
*e3723e1fSApple OSS Distributions                    unit = percentage
*e3723e1fSApple OSS Distributions                    larger_better = false
*e3723e1fSApple OSS Distributions                end
*e3723e1fSApple OSS Distributions                benchmark.writer:add_value(k, unit, tonumber(v), {
*e3723e1fSApple OSS Distributions                  [perfdata.larger_better] = larger_better,
*e3723e1fSApple OSS Distributions                  threads = test.num_cores,
*e3723e1fSApple OSS Distributions                  variant = benchmark.opt.variant
*e3723e1fSApple OSS Distributions                })
*e3723e1fSApple OSS Distributions            end
*e3723e1fSApple OSS Distributions        end
*e3723e1fSApple OSS Distributions    end
*e3723e1fSApple OSS Distributionsend
*e3723e1fSApple OSS Distributions
*e3723e1fSApple OSS Distributionsbenchmark:finish()