Releases: BrokkAi/usagebench
Releases · BrokkAi/usagebench
Release list
v0.3.0
What's Changed
- Publish v0.2.0 evaluation results by @DavidBakerEffendi in #116
- Add publication-safe retrospective legacy promotion tier by @DavidBakerEffendi in #123
- Freeze balanced legacy promotion cohort by @DavidBakerEffendi in #124
- Complete real-project-v2 evaluation slice by @DavidBakerEffendi in #126
- Fix real-project-v2 freeze on macOS by @DavidBakerEffendi in #127
- Fix Bifrost source preparation for evaluation freeze by @DavidBakerEffendi in #128
- Harden GitHub Actions security boundaries by @DavidBakerEffendi in #129
- Allow approved ephemeral runner for evaluation freeze by @DavidBakerEffendi in #130
- Split v0.3.0 evaluation freeze into bounded shards by @DavidBakerEffendi in #132
- Record legacy promotion milestones 1-7 review by @DavidBakerEffendi in #125
- Upgrade active Bifrost candidate to v0.9.3 by @DavidBakerEffendi in #133
- Cache Bifrost profiling artifacts and provenance by @DavidBakerEffendi in #136
- Pin active Bifrost candidate to merged fixes by @DavidBakerEffendi in #137
- Fix Apple clangd readiness and request cancellation by @DavidBakerEffendi in #141
- Fix rust-analyzer ContentModified races by @DavidBakerEffendi in #143
- Cache checksum-addressed canonical freeze images by @DavidBakerEffendi in #142
- Complete legacy promotion balanced core by @DavidBakerEffendi in #144
- Publish stratified UsageBench evidence tiers by @DavidBakerEffendi in #145
- Fix Bifrost freeze shard aggregation by @DavidBakerEffendi in #146
- Fix v2 Bifrost candidate provenance by @DavidBakerEffendi in #147
- Fix Apple clangd freeze identity and cache builds by @DavidBakerEffendi in #148
Full Changelog: v0.2.0...v0.3.0
v0.2.0
What's Changed
- Add reproducibility evidence for advertised profiles by @DavidBakerEffendi in #86
- Add location-level precision, recall, and range-quality metrics by @DavidBakerEffendi in #87
- Add frozen real-project evaluation protocol by @DavidBakerEffendi in #88
- Capture real-project evaluation population by @DavidBakerEffendi in #92
- Add reviewed real-project-v1 evaluation corpus by @DavidBakerEffendi in #94
- Freeze initial real-project-v1 evaluation slice by @DavidBakerEffendi in #95
- Preregister real-project-v2 evaluation slice by @DavidBakerEffendi in #96
- Add published JVM semantic-pack benchmarks by @DavidBakerEffendi in #97
- Fix Bifrost batch scan budgeting by @DavidBakerEffendi in #100
- Resolve Bifrost type-alias search hits by @DavidBakerEffendi in #102
- Benchmark workspace generated behavior models by @DavidBakerEffendi in #101
- Fix resilient Bifrost benchmark execution by @DavidBakerEffendi in #104
- Add blinded agent review protocol by @DavidBakerEffendi in #105
- Enhancement: record blinded agent-panel pilot by @DavidBakerEffendi in #106
- Enhancement: support per-case agent review sessions by @DavidBakerEffendi in #108
- Complete real-project-v1 agent panel review milestones by @DavidBakerEffendi in #109
- Promote real-project-v1 evaluation publication by @DavidBakerEffendi in #110
- Prepare UsageBench v0.2.0 release by @DavidBakerEffendi in #111
- Fix Git support in reference runtimes by @DavidBakerEffendi in #112
- Fix directory symlinks in LSP source copies by @DavidBakerEffendi in #113
- Fix evaluation report publication scope by @DavidBakerEffendi in #114
Full Changelog: v0.1.0...v0.2.0
v0.1.0 development snapshot
What's Changed
- Add Brokk configuration, Scala 3 style guide, and refactor CPG creation by @DavidBakerEffendi in #3
- Exclude external type declarations from usage analysis by @DavidBakerEffendi in #5
- Add pygen: A Python usage extraction tool using Jedi by @DavidBakerEffendi in #6
- feat: add LSP-shaped benchmark schema by @DavidBakerEffendi in #13
- Curate initial multi-language baseline corpus by @DavidBakerEffendi in #14
- Add Bifrost runner for source location benchmark cases by @DavidBakerEffendi in #15
- Score Bifrost usage benchmark results by @DavidBakerEffendi in #16
- Enable definition lookups by default by @DavidBakerEffendi in #17
- Add daily Bifrost usage benchmark workflow by @DavidBakerEffendi in #18
- Report benchmark improvements by @DavidBakerEffendi in #19
- Treat import binding references as benchmark false positives by @DavidBakerEffendi in #20
- Improve benchmark workflow failure summaries by @DavidBakerEffendi in #21
- Add Bifrost working tree benchmark mode by @DavidBakerEffendi in #22
- Add skipped Ruby usage benchmarks by @DavidBakerEffendi in #23
- Promote resolved benchmark cases to passing by @DavidBakerEffendi in #24
- Add CommonJS exported member recall case by @DavidBakerEffendi in #27
- Add TS exported-symbol usage recall case by @DavidBakerEffendi in #28
- Add Rust type lookup benchmark coverage by @DavidBakerEffendi in #29
- Update Bifrost baseline benchmark expectations by @DavidBakerEffendi in #30
- Handle Ruby dollar-qualified Bifrost symbols by @DavidBakerEffendi in #32
- Add Rust sibling associated type regression fixture by @DavidBakerEffendi in #34
- Promote improved Ruby baseline cases by @DavidBakerEffendi in #35
- Add LSP parity corpus plan and seed cases by @DavidBakerEffendi in #36
- Update Bifrost baseline expectations by @DavidBakerEffendi in #37
- Promote improved benchmark cases to passing by @DavidBakerEffendi in #38
- Align C++ class-reference benchmark with qualifier semantics by @DavidBakerEffendi in #40
- Add unscored benchmark reporting buckets by @DavidBakerEffendi in #41
- Enhance benchmark summary with improved pass counts by @DavidBakerEffendi in #42
- Update Bifrost baseline expectations by @DavidBakerEffendi in #43
- Allow Java override parity extras by @DavidBakerEffendi in #44
- Forward resolved selectors to location scans by @DavidBakerEffendi in #45
- Include unproven usage locations in benchmarks by @DavidBakerEffendi in #46
- Enforce explicit proof tiers in benchmark scoring by @DavidBakerEffendi in #47
- Add language precision benchmark cases by @DavidBakerEffendi in #48
- Remove resolved TypeScript barrel XFAILs by @DavidBakerEffendi in #50
- Generalize UsageBench with LSP adapters by @DavidBakerEffendi in #51
- Add versioned benchmark releases and citation metadata by @DavidBakerEffendi in #52
- Redesign docs around benchmark results by @DavidBakerEffendi in #55
- Expand macro-generated usage benchmark coverage by @DavidBakerEffendi in #56
- Harden benchmark methodology and ground-truth review by @DavidBakerEffendi in #57
- Tighten navigation contract reporting by @DavidBakerEffendi in #59
- Add reproducible reference container environments by @DavidBakerEffendi in #60
- Complete C++ human ground-truth audit by @DavidBakerEffendi in #61
- Promote precise Java baseline cases by @DavidBakerEffendi in #62
- Complete C# human ground-truth audit by @DavidBakerEffendi in #64
- Complete Go human ground-truth audit by @DavidBakerEffendi in #65
- Complete JavaScript human ground-truth audit by @DavidBakerEffendi in #66
- Update reference Bifrost to v0.8.8 by @DavidBakerEffendi in #67
- Complete PHP human ground-truth audit by @DavidBakerEffendi in #68
- Use Bifrost declaration navigation by @DavidBakerEffendi in #69
- Complete Python human ground-truth audit by @DavidBakerEffendi in #70
- Complete Ruby human ground-truth audit by @DavidBakerEffendi in #71
- Complete Scala human ground-truth audit by @DavidBakerEffendi in #72
- Complete TypeScript human ground-truth audit by @DavidBakerEffendi in #73
- Document completed human ground-truth audit and synchronized results by @DavidBakerEffendi in #74
- Fix Bifrost same-owner reference benchmark regressions by @DavidBakerEffendi in #75
- Add compatibility-aware navigation scoring by @DavidBakerEffendi in #76
- Add manually triggered benchmark freeze and release pipeline by @DavidBakerEffendi in #83
- Publish immutable benchmark result fragments by @DavidBakerEffendi in #84
- Fix immutable release tag creation by @DavidBakerEffendi in #85
New Contributors
- @DavidBakerEffendi made their first contribution in #3
Full Changelog: https://github.com/BrokkAi/usagebench/commits/v0.1.0