Julian Lou
Julian2002
AI & ML interests
Large Language Model:
- Model Architecture: Inference Acceleration, Long Document;
- Model Training: PT, CPT;
- Model Customization: SFT, Alignment;
- Model Agent: RL, RAG.
Organizations
None yet
models 9
Julian2002/PDP-Qwen3-8B-SFT-LoRA
Text Generation • Updated • 8
Julian2002/PDP-Qwen3-8B-SFT
Text Generation • 8B • Updated • 13
Julian2002/Llama-3.1-8B-Instruct-Medical-ChatBot-lora
Updated
Julian2002/Llama-3.1-Medical-8B-lora
Updated
Julian2002/Llama-3.1-Medical-8B-ChatBot-lora
Updated
Julian2002/Llama-3.1-Medical-8B-RM-lora
Updated
Julian2002/Llama-3.1-Medical-8B-DPO-lora
Updated • 1
Julian2002/Llama-3.1-Medical-8B-Instruct-lora
Updated
Julian2002/JulianLou_TinyLLaMA_medical_sft
Text Generation • 16.5M • Updated • 8
datasets 9
Julian2002/OPTS-TTPO-ENV
Updated • 8
Julian2002/RLVR-Math-16k
Viewer • Updated • 17.2k • 24
Julian2002/Medical-ChatBot-ReFT
Viewer • Updated • 100k • 20
Julian2002/Medical-LM-32B-SFT
Viewer • Updated • 158k • 37
Julian2002/Medical-LM-32B-Preference
Viewer • Updated • 46.9k • 46
Julian2002/Medical-LM-32B-Reasoning
Viewer • Updated • 89.6k • 11
Julian2002/Medical-ChatBot-SFT
Viewer • Updated • 318k • 28
Julian2002/Medical-ChatBot-CPT
Viewer • Updated • 120k • 29
Julian2002/Medical-ChatBot-DPO
Viewer • Updated • 164k • 64 • 1