Abstract

LLM fingerprinting via watermark distillation embeds a statistical watermark signal into model weights, enabling model owners to identify their models behind black-box APIs. Revisiting a recent protocol, we find that its utility evaluation understates text quality degradation in open-ended generation, favoring overly strong watermark teachers. Weakening the watermark improves text quality but sacrifices detectability. To move beyond this trade-off, we rethink whether text watermarks designed for verifying generated text are suitable distillation teachers for model fingerprinting. Such watermarks are typically designed to remain detectable from an individual output, limiting how sparse the watermark signal can be. In contrast, fingerprint verification can aggregate signal across queries, making sparser watermark signals viable. This raises a key question: where should the sparse signal be placed? We analyze signal placement through token surprisal and show that, even at comparable watermark strength, different placements can target tokens with different plausibility under the base model. This motivates near-tie restriction, which uses top-1-relative logit gaps to restrict the watermark bias to tokens close to the base model's top prediction. Across multiple models, near-tie improves detection--quality frontiers under deployment changes, preserves higher text quality across query budgets, and further improves existing watermarking schemes when combined with them.

Keywords

Subject

Publication details

Journal
Not available
Open access
Green open access

Cite this article

APA 7

Hwang, J., Nasery, A., Oh, S., & Ok, J. (2026). Language Model Fingerprinting Requires Rethinking Watermark Teachers. https://omanscience.com/en/articles/language-model-fingerprinting-requires-rethinking-watermark-teachers

MLA 9

Hwang, Jeongyeon, et al. "Language Model Fingerprinting Requires Rethinking Watermark Teachers." https://omanscience.com/en/articles/language-model-fingerprinting-requires-rethinking-watermark-teachers.

Chicago (author–date)

Hwang, Jeongyeon, Anshul Nasery, Sewoong Oh, and Jungseul Ok. 2026. "Language Model Fingerprinting Requires Rethinking Watermark Teachers." https://omanscience.com/en/articles/language-model-fingerprinting-requires-rethinking-watermark-teachers.

Harvard

Hwang, J., Nasery, A., Oh, S. and Ok, J. (2026) 'Language Model Fingerprinting Requires Rethinking Watermark Teachers', Available at: https://omanscience.com/en/articles/language-model-fingerprinting-requires-rethinking-watermark-teachers.

Vancouver

Hwang J, Nasery A, Oh S, Ok J. Language Model Fingerprinting Requires Rethinking Watermark Teachers. https://omanscience.com/en/articles/language-model-fingerprinting-requires-rethinking-watermark-teachers

IEEE

J. Hwang, A. Nasery, S. Oh, and J. Ok, "Language Model Fingerprinting Requires Rethinking Watermark Teachers," https://omanscience.com/en/articles/language-model-fingerprinting-requires-rethinking-watermark-teachers.