Inference Providers
Active filters: dpo
taicheng/zephyr-7b-align-scan-0.0-0.2-polynomial-3
Text Generation
• 7B • Updated • 6
taicheng/zephyr-7b-align-scan-0.0-0.8-cosine-1
Text Generation
• 7B • Updated • 7
taicheng/zephyr-7b-align-scan-0.0-0.7-cosine-3
Text Generation
• 7B • Updated • 5
taicheng/zephyr-7b-align-scan-0.0-0.3-polynomial-3
Text Generation
• 7B • Updated • 5
taicheng/zephyr-7b-align-scan-0.0-1.0-linear-2
Text Generation
• 7B • Updated • 8
taicheng/zephyr-7b-align-scan-0.0-0.9-polynomial-3
Text Generation
• 7B • Updated • 6
taicheng/zephyr-7b-align-scan-0.0-0.4-polynomial-2
Text Generation
• 7B • Updated • 6
taicheng/zephyr-7b-align-scan-0.0-0.3-linear-3
Text Generation
• 7B • Updated • 5
SongTonyLi/gemma-2b-it-DPO-D1-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 3B • Updated • 4
taicheng/zephyr-7b-align-scan-0.0-0.3-polynomial-1
Text Generation
• 7B • Updated • 7
yuvraj17/Llama3-8B-SuperNova-Spectrum-Hermes-DPO
Text Generation
• 8B • Updated • 21
SongTonyLi/OpenELM-450M-CPT-D1_chosen-then-DPO-D2a-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 0.5B • Updated • 4
SongTonyLi/OpenELM-450M-DPO-D1-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 0.5B • Updated • 5
SongTonyLi/OpenELM-270M-CPT-D1_chosen-then-DPO-D2a-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 0.3B • Updated • 8
SongTonyLi/OpenELM-270M-DPO-D1-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 0.3B • Updated • 6
SongTonyLi/OpenELM-1_1B-CPT-D1_chosen-then-DPO-D2a-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 1B • Updated • 6
SongTonyLi/OpenELM-1_1B-DPO-D1-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 1B • Updated • 4
mradermacher/Llama3-8B-SuperNova-Spectrum-Hermes-DPO-GGUF
8B • Updated • 36
mradermacher/Llama3-8B-SuperNova-Spectrum-Hermes-DPO-i1-GGUF
8B • Updated • 142
kco4776/llama3.1-8B-ko-dpo
Text Generation
• 8B • Updated • 4
nielsijzerman/NeuralAirDevil-8B-abliterated-Airoboros_trained-iq4_nl-imat.GGUF
8B • Updated • 3
Flowersea37/zephyr-7b-dpo-qlora
yuvraj17/Llama3-8B-SuperNova-Spectrum-Hermes-DPO-GGUF
Text Generation
• 8B • Updated • 53
Text Generation
• 0.5B • Updated • 70
• 4
SongTonyLi/OpenELM-3B-SFT-D1_chosen-then-DPO_D2a-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 3B • Updated • 6
Katayoon/CDPO-Zephyr-7B-iter-1
7B • Updated • 8
SongTonyLi/OpenELM-3B-CPT-D1_chosen-then-DPO-D2a-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 3B • Updated • 4
SongTonyLi/OpenELM-3B-DPO-D1-HuggingFaceH4-ultrafeedback_binarized-Xlarge
Text Generation
• 3B • Updated • 3
Katayoon/CDPO-Zephyr-7B-iter-2
7B • Updated • 9
SongTonyLi/Phi-3.5-mini-instruct-CPT-D1_chosen-then-DPO-D2a-dpo-mix-shuffled5
Text Generation
• 4B • Updated • 5