Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Alvin
AZH04
6
Follow
21world's profile picture
1 follower
·
5 following
AI & ML interests
None yet
Recent Activity
updated
a model
about 19 hours ago
AZH04/maxrl-gsm8k-skipjack-b32
updated
a model
about 24 hours ago
AZH04/SmolLM2-360M-base-gsm8k-boxed-sft-ep49
published
a model
about 24 hours ago
AZH04/SmolLM2-360M-base-gsm8k-boxed-sft-ep49
View all activity
Organizations
AZH04
's models
24
Sort: Recently updated
AZH04/maxrl-gsm8k-skipjack-b32
Updated
about 2 hours ago
AZH04/SmolLM2-360M-base-gsm8k-boxed-sft-ep49
0.4B
•
Updated
about 24 hours ago
•
16
AZH04/SmolLM2-360M-base-gsm8k-boxed-sft-ep32
0.4B
•
Updated
about 24 hours ago
•
14
AZH04/SmolLM2-360M-base-gsm8k-boxed-sft-ep24
0.4B
•
Updated
about 24 hours ago
•
15
AZH04/SmolLM2-360M-base-gsm8k-boxed-sft-ep16
0.4B
•
Updated
about 24 hours ago
•
14
AZH04/maxrl-gsm8k-skipjack-2
Updated
1 day ago
AZH04/SmolLM2-360M-base-gsm8k-boxed-sft-ep12
0.4B
•
Updated
1 day ago
•
15
AZH04/SmolLM2-360M-base-gsm8k-boxed-sft
0.4B
•
Updated
1 day ago
•
24
AZH04/SmolLM2-360M-base-gsm8k-boxed-sft-ep9
0.4B
•
Updated
1 day ago
•
14
AZH04/maxrl-gsm8k-skipjack-ckpts-b32
Updated
1 day ago
AZH04/maxrl-gsm8k-skipjack-ckpts
Updated
2 days ago
AZH04/maxrl-gsm8k-skipjack
Updated
2 days ago
AZH04/SmolLM2-360M-instruct-gsm8k-boxed-sft
0.4B
•
Updated
5 days ago
•
12
AZH04/qwen35-4b-v6-2-sft-merged
Updated
11 days ago
AZH04/qwen35-4b-proposer-sft-v8-merged
Updated
11 days ago
AZH04/cache-v7gen3
Updated
12 days ago
AZH04/cache-zk7m
Updated
14 days ago
AZH04/v8
Updated
Jul 21
AZH04/v7
Updated
Jul 21
AZH04/v6
Updated
Jul 21
AZH04/v5
Updated
Jul 21
AZH04/Taxi-v3
Reinforcement Learning
•
Updated
Feb 17, 2025
AZH04/q-FrozenLake-v1-4x4-noSlippery
Reinforcement Learning
•
Updated
Feb 17, 2025
AZH04/ppo-LunarLander-v2
Reinforcement Learning
•
Updated
Dec 27, 2024