Zzong's Notes
Search
검색
다크 모드
라이트 모드
탐색기
LLM
47건의 항목
2026년 7월 20일
Generalized Knowledge Distillation
LLM
distillation
2026년 7월 08일
LLMLingua - Prompt Compression for LLM Inference
LLM
inference
prompt_compression
RAG
paper_review
y2023
y2024
2026년 7월 08일
Prompt Compression Trends - From Token Pruning to Context Engineering
LLM
inference
prompt_compression
context_compression
RAG
y2026
2026년 7월 08일
Prompt Compression
LLM
inference
prompt_compression
2026년 7월 08일
Prefill
LLM
inference
serving
latency
2026년 6월 29일
Train Large Model
LLM
deepspeed
2026년 6월 28일
FP8 Quantization
LLM
quantization
inference
serving
Qwen
2026년 6월 28일
Group Sequence Policy Optimization
LLM
reinforcement_learning
post_training
RLVR
policy_optimization
Qwen
2026년 6월 28일
Group Relative Policy Optimization
reinforcement_learning
LLM
2026년 6월 28일
DPO를 한 문장으로 잡기
LLM
2026년 6월 28일
자연스러운 한국어를 위한 LLM Post-Training
LLM
post_training
alignment
instruction_tuning
korean
2026년 6월 24일
Prompt 종류
NLP
LLM
2026년 6월 14일
Batch Decoding
LLM
2026년 6월 14일
Hallucination
LLM
2026년 6월 14일
FastChat
LLM
2026년 6월 14일
polyglot
LLM
korean
NLP
2026년 6월 14일
RLHF
LLM
reinforcement_learning
2026년 6월 14일
TrainerCallback
huggingface
deep_learning
LLM
2026년 6월 14일
DistributedDataParallel
deep_learning
LLM
2026년 6월 14일
GPT-2
LLM
2026년 6월 14일
GPT
NLP
LLM
2026년 6월 14일
LVLM 를 따라하는 정보 넣기
LLM
LVLM
2026년 6월 14일
Llama
LLM
2026년 6월 14일
LoRA
LLM
2026년 6월 14일
Proximal Policy Optimization
reinforcement_learning
LLM
2026년 6월 14일
T5
summarization
LLM
2026년 6월 14일
deepspeed
deep_learning
LLM
2026년 6월 14일
vllm
LLM
2026년 6월 14일
llm_as_classifier
LLM
2026년 6월 14일
vicuna
LLM
2026년 6월 14일
MT-bench
LMSYS
LLM
evaluation
2026년 6월 14일
supervised fine-tuning
deep_learning
LLM
2026년 6월 14일
DeepSpeed-MoE
MoE
deep_learning
LLM
2026년 6월 14일
LLMOps
MLOps
LLM
generative_model
server
inference
pipeline
2026년 6월 14일
Revisiting Reinforcement Learning for LLM Reasoning from A Cross-Domain Perspective
LLM
paper_review
2026년 6월 14일
BEQUE - Large Language Model based Long-tail Query Rewriting in Taobao Search
e-commerce
WWW
paper_review
query_rewriting
LLM
y2024
todo
trans
2026년 6월 14일
Chain of Hindsight Aligns Language Models with Feedback
language_model
LLM
nlp
paper_review
y2023
2026년 6월 14일
Compact Language Models via Pruning andKnowledge Distillation
language_model
distillation
pruning
LLM
nlp
paper_review
sLLM
2026년 6월 14일
DialogLM
language_model
LLM
Microsoft
NLP
nlp
paper_review
summarization
y2022
2026년 6월 14일
LIMA
language_model
LLM
nlp
paper_review
2026년 6월 14일
Reinforcement Learning with Verifiable Rewards Implicitly Incentivizes Correct Reasoning in Base LLMs
LLM
RLVR
paper_review
reinforcement_learning
2026년 6월 14일
A Survey on AI Search with LargeLanguage Models
retrieval
IR
survey
LLM
2026년 6월 14일
LLM2Vec
embedding
dense_retrieval
LLM
2026년 6월 14일
GRAM - Generative Retrieval and Alignment Model
retrieval
e-commerce
generative_retrieval
LLM
paper_review
y2025
JD
2026년 6월 14일
LREF
retrieval
IR
paper_review
LLM
e-commerce
relevance
y2025
2026년 6월 14일
Towards More Relevant Product Search Ranking Via Large Language Models
retrieval
e-commerce
ranking
LLM
learning_to_rank
paper_review
2026년 6월 14일
Yelp - Search Query Understanding with LLMs
retrieval
e-commerce
query_understanding
LLM