simplescaling
/

token-conditional-control

Text Generation

Generated from Trainer

text-generation-inference

Model card Files Files and versions Metrics Training metrics Community

token-conditional-control / README.md

Muennighoff's picture

Update README.md

9ddcc0f verified 6 months ago

|

819 Bytes

metadata

base_model: Qwen/Qwen2.5-32B-Instruct
library_name: transformers
model_name: step-conditional-control
tags:
  - generated_from_trainer
  - trl
  - sft
license: apache-2.0

Model Summary

Repository: simplescaling/s1
Paper: TODO

Use

This is the token-conditional control model for our paper. You can evaluate using the information here.

Training information

TRL: 0.13.0
Transformers: 4.48.0
Pytorch: 2.3.1
Datasets: 3.0.1
Tokenizers: 0.21.0

Citation

TODO