Likeremote

Subscribe to the latest remote jobs:

  • Likeremote jobs on https://LinkedIn.com/
  • Likeremote jobs on https://telegram.org/
  • Likeremote jobs on Reddit.com
LA

LLM Inference Engineer

LG AI Research
πŸ‡°πŸ‡· South Korea
On-site
12 months ago
  • AI
  • MLOps
  • vLLM
  • Ollama
  • Python
  • C++
  • TensorFlow
  • PyTorch
  • ONNX
  • CUDA
  • Beam
Not scoredNo CV on file. Upload one and this job gets a score out of 100.Upload CV

νŒ€ μ†Œκ°œ

Platform&Infra Team은 AIλͺ¨λΈμ˜ κ°œλ°œλΆ€ν„° μ„œλΉ„μŠ€ μš΄μ˜μ„ μœ„ν•œ 배포에 이λ₯΄κΈ°κΉŒμ§€ AIλͺ¨λΈμ˜ 수λͺ… μ£ΌκΈ°λ₯Ό μ΅œμ ν™”ν•˜κ³ , 효율적으둜 κ΄€λ¦¬ν•˜κΈ° μœ„ν•œ MLOps νŒŒμ΄ν”„λΌμΈμ„ κ΅¬μΆ•ν•©λ‹ˆλ‹€. λ˜ν•œ AIμ„œλΉ„μŠ€μ˜ μ•ˆμ •μ μΈ 운영 지원을 μœ„ν•œ λ³΄μ•ˆμ„± κ°•ν™”, 인프라 관리 및 μžμ› μ΅œμ ν™” 업무λ₯Ό μˆ˜ν–‰ν•©λ‹ˆλ‹€.
νŒ€ λ‚΄μ—μ„œ LLM Inference EngineerλŠ” λŒ€κ·œλͺ¨ μ–Έμ–΄ λͺ¨λΈ(LLM)의 μΆ”λ‘  μ„±λŠ₯을 μ΅œμ ν™”ν•˜κ³ , λ‹€μ–‘ν•œ ν”„λ ˆμž„μ›Œν¬μ—μ„œ EXAONEλͺ¨λΈμ„ μ•ˆμ •μ μœΌλ‘œ μ„œλΉ™ν•  수 μžˆλŠ” 엔진을 κ°œλ°œν•©λ‹ˆλ‹€. λ˜ν•œ, μ˜€ν”ˆμ†ŒμŠ€ ν”„λ‘œμ νŠΈμ˜ 곡식 채널을 톡해 μš”μ²­λ˜λŠ” κΈ°λŠ₯ κ°œμ„ , 버그 μˆ˜μ •, μ„±λŠ₯ μ΅œμ ν™” λ“±μ˜ μš”κ±΄μ— λŒ€μ‘ν•˜λ©°, λ‹€μ–‘ν•œ ν™˜κ²½μ—μ„œ LLM이 μ•ˆμ •μ μœΌλ‘œ λ™μž‘ν•  수 μžˆλ„λ‘ κΈ°μ—¬ν•©λ‹ˆλ‹€.

μˆ˜ν–‰ 업무

  • LLM μΆ”λ‘  μ„±λŠ₯ μ΅œμ ν™”: λŒ€κ·œλͺ¨ μ–Έμ–΄ λͺ¨λΈ(LLM)의 μΆ”λ‘  μ„±λŠ₯을 κ·ΉλŒ€ν™”ν•˜κΈ° μœ„ν•œ κ°œμ„  λ°©μ•ˆμ„ λ„μΆœν•˜κ³  섀계에 μ°Έμ—¬ν•©λ‹ˆλ‹€.
  • μ„œλΉ™ μ—”μ§„ 개발: λ‹€μ–‘ν•œ ν”„λ ˆμž„μ›Œν¬ μƒμ—μ„œ 엑사원 λͺ¨λΈμ„ μ•ˆμ •μ μœΌλ‘œ μ„œλΉ™ν•  수 μžˆλŠ” 엔진을 κ°œλ°œν•©λ‹ˆλ‹€.
  • μ˜€ν”ˆμ†ŒμŠ€ κΈ°μ—¬: μ˜€ν”ˆμ†ŒμŠ€ LLM μ„œλΉ™ ν”„λ ˆμž„μ›Œν¬(vLLM, SGLang, Ollama λ“±)의 곡식 채널을 톡해 μš”μ²­λ˜λŠ” κΈ°λŠ₯ κ°œμ„ , 버그 μˆ˜μ •, μ„±λŠ₯ μ΅œμ ν™” λ“±μ˜ μš”κ±΄μ— λŒ€μ‘ν•˜κ³  κΈ°μ—¬ν•©λ‹ˆλ‹€.
  • λ‹€μ–‘ν•œ ν™˜κ²½ 지원: chat_template을 ν™œμš©ν•˜μ—¬ λ‹€μ–‘ν•œ 언어와 ν™˜κ²½μ—μ„œ LLM이 μ˜¬λ°”λ₯΄κ²Œ λ™μž‘ν•  수 μžˆλ„λ‘ μ μš©ν•˜κ³  κ°œμ„ ν•©λ‹ˆλ‹€.
  • λͺ¨λΈ μΆ”λ‘  가속화: NPU/GPU 기반의 Serving μ „λž΅μ„ μ„€κ³„ν•˜κ³ , λͺ¨λΈ μΆ”λ‘  가속화 μ•Œκ³ λ¦¬μ¦˜μ„ 연ꡬ 및 κ΅¬ν˜„ν•©λ‹ˆλ‹€.


μ§€μ›μžκ²©

  • λͺ¨λΈ μΆ”λ‘  가속화 및 Inference Back-end κ΅¬ν˜„ κ²½ν—˜: λͺ¨λΈ μΆ”λ‘  μ„±λŠ₯을 높이기 μœ„ν•œ μ•Œκ³ λ¦¬μ¦˜ 연ꡬ 및 κ΅¬ν˜„ κ²½ν—˜
  • NPU/GPU 기반 Serving μ „λž΅ 및 개발 κ²½ν—˜: NPU/GPUλ₯Ό ν™œμš©ν•œ λͺ¨λΈ μ„œλΉ™ μ „λž΅ 섀계 및 κ΅¬ν˜„ κ²½ν—˜
  • μ˜€ν”ˆμ†ŒμŠ€ LLM Serving Framework κΈ°μ—¬ κ²½ν—˜: vLLM, SGLang, Ollama λ“± μ˜€ν”ˆμ†ŒμŠ€ LLM μ„œλΉ™ ν”„λ ˆμž„μ›Œν¬μ— κΈ°μ—¬ν•œ κ²½ν—˜(contribution)


*μš°λŒ€μ‚¬ν•­Β 

  • λ¨Έμ‹ λŸ¬λ‹ λͺ¨λΈ 수λͺ… 주기에 λŒ€ν•œ 이해: λͺ¨λΈ 개발, ν•™μŠ΅, μ„œλΉ™, 배포 λ“± 각 단계에 λŒ€ν•œ κ²½ν—˜κ³Ό 이해
  • AI 및 λ¨Έμ‹ λŸ¬λ‹ κΈ°μˆ μ— λŒ€ν•œ κΉŠμ€ 이해: Python, C++, TensorFlow, PyTorch, ONNX, CUDA, NPU λ“± AI 및 λ¨Έμ‹ λŸ¬λ‹ κ΄€λ ¨ κΈ°μˆ μ— λŒ€ν•œ μˆ™λ ¨λ„
  • Transformer 기반 λͺ¨λΈ 및 LLM에 λŒ€ν•œ 이해: Attention λ©”μ»€λ‹ˆμ¦˜, λŒ€κ·œλͺ¨ μ–Έμ–΄ λͺ¨λΈ(LLM)의 ꡬ쑰와 λ™μž‘ 원리에 λŒ€ν•œ κΉŠμ€ 이해
  • LLM λ””μ½”λ”© μ „λž΅ 및 μΆ”λ‘  κΈ°μˆ μ— λŒ€ν•œ 이해: Greedy Search, Beam Search, Top-k Sampling λ“± λ””μ½”λ”© μ „λž΅μ— λŒ€ν•œ 이해
  • chat_template ν™œμš© κ²½ν—˜: λ‹€μ–‘ν•œ ν™˜κ²½μ—μ„œ LLM이 μ˜¬λ°”λ₯΄κ²Œ λ™μž‘ν•  수 μžˆλ„λ‘ chat_template을 μ„€κ³„ν•˜κ³  μ μš©ν•œ κ²½ν—˜


μ „ν˜•μ ˆμ°¨

  • μ„œλ₯˜μ‹¬μ‚¬ β†’ μ½”λ”©ν…ŒμŠ€νŠΈ β†’ 1μ°¨Β  PT직무 인터뷰(온라인) β†’ 2μ°¨Β  직무 인터뷰(온라인) β†’ LG AI Fit Check(온라인) β†’ μ΅œμ’… 합격

* μ „ν˜• μ ˆμ°¨λŠ” 변경될 수 μžˆμŠ΅λ‹ˆλ‹€. μ„œλ₯˜ 합격 μ‹œ μ „ν˜• μ ˆμ°¨μ— λŒ€ν•΄ λ³„λ„λ‘œ μ•ˆλ‚΄ λ“œλ¦½λ‹ˆλ‹€.

ν˜„μž¬ LG AI연ꡬ원은 병역지정업체가 μ•„λ‹ˆλ―€λ‘œ, μ „λ¬Έμ—°κ΅¬μš”μ› μ±„μš© 및 전직이 λΆˆκ°€ν•¨μ„ μ•Œλ €λ“œλ¦½λ‹ˆλ‹€.
μ§€μ›μ‹œ λ¬Έμ œκ°€ μžˆμ„ 경우careers@lgresearch.ai 둜 문의 λΆ€νƒλ“œλ¦½λ‹ˆλ‹€.

LLM Inference Engineer Β· LG AI Research

Auto apply with Likeremote