Jinghan Peng
Jayden98
·
AI & ML interests
LLMs, Imitation Learning
Recent Activity
upvoted a paper 1 day ago
MECT: Mixture of Experts with CNN-Transformer Network for Speaker verification updated a model 1 day ago
AntResearch/AntSpeaker upvoted a paper 1 day ago
Realtime-Venus: A full-duplex interaction system with asynchronous delegationOrganizations
Vision-To-Text
-
llava-hf/llava-1.5-7b-hf
Image-Text-to-Text • 7B • Updated • 1.66M • 375 -
llava-hf/llava-v1.6-mistral-7b-hf
Image-Text-to-Text • 8B • Updated • 512k • 315 -
llava-hf/llava-v1.6-vicuna-7b-hf
Image-Text-to-Text • 7B • Updated • 24.1k • 34 -
llava-hf/vip-llava-7b-hf
Image-Text-to-Text • 7B • Updated • 19.3k • 16
Gemma
Qwen
Dataset
LLAMA
Vision-To-Text
-
llava-hf/llava-1.5-7b-hf
Image-Text-to-Text • 7B • Updated • 1.66M • 375 -
llava-hf/llava-v1.6-mistral-7b-hf
Image-Text-to-Text • 8B • Updated • 512k • 315 -
llava-hf/llava-v1.6-vicuna-7b-hf
Image-Text-to-Text • 7B • Updated • 24.1k • 34 -
llava-hf/vip-llava-7b-hf
Image-Text-to-Text • 7B • Updated • 19.3k • 16
challenges
Gemma
Text-To-Speach
Qwen