Hugging Face's logo Hugging Face
  • Models
  • Datasets
  • Spaces
  • Buckets new
  • Docs
  • Enterprise
  • Pricing
    • Website
      • Tasks
      • HuggingChat
      • Collections
      • Languages
      • Organizations
    • Community
      • Blog
      • Posts
      • Daily Papers
      • Hardware
      • Learn
      • Discord
      • Forum
      • GitHub
    • Solutions
      • Team & Enterprise
      • Hugging Face PRO
      • Enterprise Support
      • Inference Providers
      • Inference Endpoints
      • Storage Buckets

  • Log In
  • Sign Up

On-Policy Self-Distillation without Any Supervision

university
Activity Feed

AI & ML interests

None defined yet.

Recent Activity

williamium  submitted a paper about 14 hours ago
Learn What's Left, Not What's Mastered: Saturation Aware Advantage Reweighting for Multi-Reward Policy Optimization
williamium  submitted a paper 1 day ago
Self-Supervised Visual On-Policy Distillation
williamium  submitted a paper 7 days ago
On-Policy Self-Distillation without Any Supervision
View all activity

William Li's profile picture

u-opsd 's models 4

u-opsd/qwen3-8b-non-thinking

Text Generation • Updated 14 days ago • 15

u-opsd/qwen3-4b-thinking

Text Generation • Updated 14 days ago • 79

u-opsd/qwen3-8b-thinking

Text Generation • Updated 14 days ago • 15

u-opsd/qwen3-4b-non-thinking

Text Generation • Updated 14 days ago • 20
Company
TOS Privacy About Careers
Website
Models Datasets Spaces Pricing Docs