Model Hub
Browse PQC-verified AI models, datasets, and tools
P
PKU-Alignment/beaver-7b-v1.0-cost HF
Unverified
Reinforcement-LearningSafe-RlhfSafetensorsLLaMAReinforcement-Learning-From-Human-FeedbackBeaver HIGH
4K 10
Updated 2026-07-16 M
mradermacher/Vero-Qwen35-9B-Base-i1-GGUF HF
Unverified
Reinforcement-LearningTransformersGGUFVeroVision-Language-ModelMultimodal HIGH
4K 0
Updated 2026-07-18 M
mradermacher/SpatialThinker-30B-i1-GGUF HF
Unverified
Reinforcement-LearningTransformersGGUFSpatial-ReasoningMultimodalVision-Language HIGH
4K 0
Updated 2026-06-25 M
mradermacher/SpatialThinker-7B-i1-GGUF HF
Unverified
Reinforcement-LearningTransformersGGUFSpatial-ReasoningMultimodalVision-Language HIGH
4K 1
Updated 2026-07-09 M
mradermacher/Atomight-V2.1-0.5B-Inference-i1-GGUF HF
Unverified
Text GenerationTransformersGGUFCausal-LmGrpoReasoning HIGH
4K 1
Updated 2026-06-28 P
PKU-Alignment/beaver-7b-v1.0-reward HF
Unverified
Reinforcement-LearningSafe-RlhfSafetensorsLLaMAReinforcement-Learning-From-Human-FeedbackBeaver HIGH
3K 17
Updated 2026-07-09 T
TianheWu/VisualQuality-R1-7B HF
Unverified
Reinforcement-LearningSafetensorsQwen2_5_vlIQAReasoningVLM HIGH
3K 14
Updated 2026-07-09 G
google/tabfm-1.0.0-jax HF
Unverified
Tabular-ClassificationTabfmTabularTabular-RegressionZero-ShotIn-Context-Learning HIGH
3K 7
Updated 2026-07-23 R
RLinf/RLinf-OpenVLAOFT-LIBERO-130-Base-Lora HF
Unverified
Reinforcement-LearningSafetensorsOpenvlaRLinfCustom_codeModel-Index HIGH
3K 0
Updated 2026-07-02 M
mradermacher/LongTraceRL-30B-i1-GGUF HF
Unverified
Reinforcement-LearningTransformersGGUFLong-ContextReasoningRubric-Reward HIGH
2K 0
Updated 2026-06-28 Showing 10 of 290 items (page 15 of 15)
Prev Next