Zzong's Notes
Search
검색
다크 모드
라이트 모드
탐색기
Home
❯
machine_learning
❯
generative_ai
❯
LLM
LLM
38개의 글
inference
Alpaca
AWQ
quantization
channel(LLM)
Decoupled Clip and Dynamic sAmpling Policy Optimization
LLM
reinforcement_learning
post_training
RLVR
policy_optimization
ByteDance
deepspeed
deep_learning
LLM
DistributedDataParallel
deep_learning
LLM
DPO
LLM
Exaone 3.0
LG
FP8 Quantization
LLM
quantization
inference
serving
Qwen
Fully Sharded Data Parallel
huggingface
accelerate
Generalized Knowledge Distillation
LLM
distillation
GPT
NLP
LLM
GPT-2
LLM
Group Relative Policy Optimization
reinforcement_learning
LLM
Group Sequence Policy Optimization
LLM
reinforcement_learning
post_training
RLVR
policy_optimization
Qwen
Large Language Model
NLP
LLM
Llama
LLM
llm_as_classifier
LLM
LoRA
LLM
LVLM 를 따라하는 정보 넣기
LLM
LVLM
MoE
On-Policy Distillation
LLM
distillation
alignment
generative_ai
Open challenges in LLM research
LLM
research
Parallelism
Prompt Engineering
LLM
NLP
Proximal Policy Optimization
reinforcement_learning
LLM
Quantization
deep_learning
quantization
reward model
RLHF
LLM
reinforcement_learning
SimLM
embedding
supervised fine-tuning
deep_learning
LLM
generative_ai
alignment
T5
summarization
LLM
Train Large Model
LLM
deepspeed
Trainer(huggingface)
huggingface
LLM
TrainerCallback
huggingface
deep_learning
LLM
vicuna
LLM
자연스러운 한국어를 위한 LLM Post-Training
LLM
post_training
alignment
instruction_tuning
korean