Skip to content

2.12.0

Choose a tag to compare

@KennethEnevoldsen KennethEnevoldsen released this 25 Mar 13:33
· 843 commits to main since this release

2.12.0 (2026-03-25)

Feature

  • feat: Evaluate Compression Methods on Retrieval Tasks (#3950)

  • Add quantization support

  • Refactor quantization support into wrapper class

  • Remove quantization from CLI and update compression wrapper

  • Change quantization level to string enum

  • Change enum type to HelpfulStrEnum

  • Use torch.dtypes for compression levels

  • Fix linter

  • Always quantize queries

  • Fix linter

  • Define quantization levels as enum

  • Rename variables

  • Rename variables and add documentation

  • Update docs for adding models and what's new section

  • update docs

  • better handle of kwargs

  • fix typing

  • Raise error on invalid clipping margins

  • Fix lint


Co-authored-by: Roman Solomatin <36135455+Samoed@users.noreply.github.com> (931683e)

Unknown

  • model: Add qihoo360/Zhinao-ChineseModernBert-Embedding (#4266)

  • add: sbert zhinao_modernbert.

  • add: sbert zhinao_modernbert.

  • update: zhinao-chinesemodernbert training datasets.

  • update: zhinao-chinesemodernbert info.

  • update: zhinao-chinesemodernbert info.

  • lint

  • update: zhinao-chinesemodernbert contacts.

  • lint


Co-authored-by: caiheng3 <caiheng3@360.cn>
Co-authored-by: Roman Solomatin <36135455+Samoed@users.noreply.github.com> (5ecdd29)