LLM Inference Engineer
- AI
- MLOps
- vLLM
- Ollama
- Python
- C++
- TensorFlow
- PyTorch
- ONNX
- CUDA
- Beam
ν μκ°
Platform&Infra Teamμ AIλͺ¨λΈμ κ°λ°λΆν° μλΉμ€ μ΄μμ μν λ°°ν¬μ μ΄λ₯΄κΈ°κΉμ§ AIλͺ¨λΈμ μλͺ
μ£ΌκΈ°λ₯Ό μ΅μ ννκ³ , ν¨μ¨μ μΌλ‘ κ΄λ¦¬νκΈ° μν MLOps νμ΄νλΌμΈμ ꡬμΆν©λλ€. λν AIμλΉμ€μ μμ μ μΈ μ΄μ μ§μμ μν 보μμ± κ°ν, μΈνλΌ κ΄λ¦¬ λ° μμ μ΅μ ν μ
무λ₯Ό μνν©λλ€.
ν λ΄μμ LLM Inference Engineerλ λκ·λͺ¨ μΈμ΄ λͺ¨λΈ(LLM)μ μΆλ‘ μ±λ₯μ μ΅μ ννκ³ , λ€μν νλ μμν¬μμ EXAONEλͺ¨λΈμ μμ μ μΌλ‘ μλΉν μ μλ μμ§μ κ°λ°ν©λλ€. λν, μ€νμμ€ νλ‘μ νΈμ 곡μ μ±λμ ν΅ν΄ μμ²λλ κΈ°λ₯ κ°μ , λ²κ·Έ μμ , μ±λ₯ μ΅μ ν λ±μ μ건μ λμνλ©°, λ€μν νκ²½μμ LLMμ΄ μμ μ μΌλ‘ λμν μ μλλ‘ κΈ°μ¬ν©λλ€.
μν μ 무
- LLM μΆλ‘ μ±λ₯ μ΅μ ν: λκ·λͺ¨ μΈμ΄ λͺ¨λΈ(LLM)μ μΆλ‘ μ±λ₯μ κ·ΉλννκΈ° μν κ°μ λ°©μμ λμΆνκ³ μ€κ³μ μ°Έμ¬ν©λλ€.
- μλΉ μμ§ κ°λ°: λ€μν νλ μμν¬ μμμ μμ¬μ λͺ¨λΈμ μμ μ μΌλ‘ μλΉν μ μλ μμ§μ κ°λ°ν©λλ€.
- μ€νμμ€ κΈ°μ¬: μ€νμμ€ LLM μλΉ νλ μμν¬(vLLM, SGLang, Ollama λ±)μ 곡μ μ±λμ ν΅ν΄ μμ²λλ κΈ°λ₯ κ°μ , λ²κ·Έ μμ , μ±λ₯ μ΅μ ν λ±μ μ건μ λμνκ³ κΈ°μ¬ν©λλ€.
- λ€μν νκ²½ μ§μ: chat_templateμ νμ©νμ¬ λ€μν μΈμ΄μ νκ²½μμ LLMμ΄ μ¬λ°λ₯΄κ² λμν μ μλλ‘ μ μ©νκ³ κ°μ ν©λλ€.
- λͺ¨λΈ μΆλ‘ κ°μν: NPU/GPU κΈ°λ°μ Serving μ λ΅μ μ€κ³νκ³ , λͺ¨λΈ μΆλ‘ κ°μν μκ³ λ¦¬μ¦μ μ°κ΅¬ λ° κ΅¬νν©λλ€.
μ§μμ격
- λͺ¨λΈ μΆλ‘ κ°μν λ° Inference Back-end ꡬν κ²½ν: λͺ¨λΈ μΆλ‘ μ±λ₯μ λμ΄κΈ° μν μκ³ λ¦¬μ¦ μ°κ΅¬ λ° κ΅¬ν κ²½ν
- NPU/GPU κΈ°λ° Serving μ λ΅ λ° κ°λ° κ²½ν: NPU/GPUλ₯Ό νμ©ν λͺ¨λΈ μλΉ μ λ΅ μ€κ³ λ° κ΅¬ν κ²½ν
- μ€νμμ€ LLM Serving Framework κΈ°μ¬ κ²½ν: vLLM, SGLang, Ollama λ± μ€νμμ€ LLM μλΉ νλ μμν¬μ κΈ°μ¬ν κ²½ν(contribution)
*μ°λμ¬νΒ
- λ¨Έμ λ¬λ λͺ¨λΈ μλͺ μ£ΌκΈ°μ λν μ΄ν΄: λͺ¨λΈ κ°λ°, νμ΅, μλΉ, λ°°ν¬ λ± κ° λ¨κ³μ λν κ²½νκ³Ό μ΄ν΄
- AI λ° λ¨Έμ λ¬λ κΈ°μ μ λν κΉμ μ΄ν΄: Python, C++, TensorFlow, PyTorch, ONNX, CUDA, NPU λ± AI λ° λ¨Έμ λ¬λ κ΄λ ¨ κΈ°μ μ λν μλ ¨λ
- Transformer κΈ°λ° λͺ¨λΈ λ° LLMμ λν μ΄ν΄: Attention λ©μ»€λμ¦, λκ·λͺ¨ μΈμ΄ λͺ¨λΈ(LLM)μ ꡬ쑰μ λμ μ리μ λν κΉμ μ΄ν΄
- LLM λμ½λ© μ λ΅ λ° μΆλ‘ κΈ°μ μ λν μ΄ν΄: Greedy Search, Beam Search, Top-k Sampling λ± λμ½λ© μ λ΅μ λν μ΄ν΄
- chat_template νμ© κ²½ν: λ€μν νκ²½μμ LLMμ΄ μ¬λ°λ₯΄κ² λμν μ μλλ‘ chat_templateμ μ€κ³νκ³ μ μ©ν κ²½ν
μ νμ μ°¨
- μλ₯μ¬μ¬ β μ½λ©ν μ€νΈ β 1μ°¨Β PTμ§λ¬΄ μΈν°λ·°(μ¨λΌμΈ) β 2μ°¨Β μ§λ¬΄ μΈν°λ·°(μ¨λΌμΈ) β LG AI Fit Check(μ¨λΌμΈ) β μ΅μ’ ν©κ²©
* μ ν μ μ°¨λ λ³κ²½λ μ μμ΅λλ€. μλ₯ ν©κ²© μ μ ν μ μ°¨μ λν΄ λ³λλ‘ μλ΄ λ립λλ€.
νμ¬ LG AIμ°κ΅¬μμ λ³μμ§μ μ
μ²΄κ° μλλ―λ‘, μ λ¬Έμ°κ΅¬μμ μ±μ© λ° μ μ§μ΄ λΆκ°ν¨μ μλ €λ립λλ€.
μ§μμ λ¬Έμ κ° μμ κ²½μ°careers@lgresearch.ai λ‘ λ¬Έμ λΆνλ립λλ€.
LLM Inference Engineer Β· LG AI Research