Live page ยท Day archive

Base Models Can Reason By Taking a Cue From Training Data

Read the original at HF Daily Papers

Summary

Researchers show that specific starting tokens, such as ".\n\nOkay," boost Olmo-3-7B's math accuracy from 42% to 78% by leveraging training data associations.

Carried by: HF Daily Papers. First seen: .