Inference Providers
Active filters: trl
abdalrifai636/maqluba-sql-gen-v2.2
Text Generation
• Updated • 127
• 1
A7med-Ame3/qwen3_lora_model
Yooniel/gemma-3-27b-it-self-preservation-dangerousness
Text Generation
• Updated • 47
• 1
ikunalar/planifest-001-adapter
Text Generation
• Updated • 7
• 1
dustin2050/finrag-gpt-oss-120b-v2
Text Generation
• Updated • 57
• 1
mirazrafi/NSFW-RP-RolePlay-LoRA-Qwen-3.5-4B
Text Generation
• Updated • 137
• 14
dslanger/NSFW-RP-RolePlay-LoRA-ArliAI-Llama-3.1-8B-F16-GGUF
Text Generation
• 41.9M • Updated • 581
• 2
Reinforcement Learning
• Updated • 2
• 1
ybelkada/gpt-neo-125m-detox
Reinforcement Learning
• Updated • 22
ybelkada/gpt-neo-125m-detoxified-long-context
Reinforcement Learning
• Updated • 17
Reinforcement Learning
• Updated • 1
• 1
SummerSigh/T5-Base-Rule-Of-Thumb-RM
Reinforcement Learning
• Updated • 2
dshin/flan-t5-ppo-testing
Reinforcement Learning
• Updated • 1
• 1
SummerSigh/T5-Base-EvilPrompterRM
Reinforcement Learning
• 0.2B • Updated • 1
dshin/flan-t5-ppo-testing-violation
Reinforcement Learning
• Updated • 2
Reinforcement Learning
• Updated • 23
dshin/flan-t5-ppo-user-h-use-violation
Reinforcement Learning
• Updated • 23
dshin/flan-t5-ppo-user-f-use-violation
Reinforcement Learning
• Updated • 3
dshin/flan-t5-ppo-user-e-use-violation
Reinforcement Learning
• Updated • 1
dshin/flan-t5-ppo-user-a-use-violation
Reinforcement Learning
• Updated • 2
dshin/flan-t5-ppo-user-h-batch-size-8-epoch-0
Reinforcement Learning
• Updated • 3
dshin/flan-t5-ppo-user-e-batch-size-8-epoch-0
Reinforcement Learning
• Updated • 2
dshin/flan-t5-ppo-user-h-batch-size-8-epoch-0-use-violation
Reinforcement Learning
• Updated • 2
dshin/flan-t5-ppo-user-a-batch-size-8-epoch-0
Reinforcement Learning
• Updated • 21
dshin/flan-t5-ppo-user-f-batch-size-8-epoch-0
Reinforcement Learning
• Updated • 3
dshin/flan-t5-ppo-user-f-batch-size-8-epoch-0-use-violation
Reinforcement Learning
• Updated • 23
dshin/flan-t5-ppo-user-e-batch-size-8-epoch-0-use-violation
Reinforcement Learning
• Updated • 3
dshin/flan-t5-ppo-user-h-batch-size-8-epoch-1
Reinforcement Learning
• Updated • 1
dshin/flan-t5-ppo-user-e-batch-size-8-epoch-1
Reinforcement Learning
• Updated • 2
dshin/flan-t5-ppo-user-a-batch-size-8-epoch-1
Reinforcement Learning
• Updated • 3