Likeremote

Subscribe to the latest remote jobs:

  • Likeremote jobs on https://LinkedIn.com/
  • Likeremote jobs on https://telegram.org/
  • Likeremote jobs on Reddit.com
LA

Research Scientist Internship(Agentic AI)

LG AI Research
๐Ÿ‡ฐ๐Ÿ‡ท South Korea
On-site
Internship
9 months ago
  • RLHF
  • Natural Language Processing
  • vLLM
  • Docker
  • Kubernetes
  • AI
Not scoredNo CV on file. Upload one and this job gets a score out of 100.Upload CV

ํŒ€ ์†Œ๊ฐœ

Data Intelligence Lab์€ ์ตœ์‹  Deep Learning ์•Œ๊ณ ๋ฆฌ์ฆ˜์„ ์—ฐ๊ตฌ/๊ฐœ๋ฐœํ•˜์—ฌ ๊ณ ๋„ํ™” ๋œ ๋ฐ์ดํ„ฐ ๋ถ„์„ ๋ฐ ์˜ˆ์ธก๊ณผ ๋ณต์žกํ•œ ๋ฐ์ดํ„ฐ์˜ ์ตœ์ ํ™”๋ฅผ ์ˆ˜ํ–‰ํ•ฉ๋‹ˆ๋‹ค.
์ด๋ฅผ ํ†ตํ•ด ์‚ฐ์—…์— ์ ์šฉํ•  ์ˆ˜ ์žˆ๋Š” ์‹ค์šฉ์  ๊ธฐ์ˆ ์„ ํ†ตํ•ด ๊ทธ๋ฃน์˜ ๋‹ค์–‘ํ•œ ์‚ฌ์—…์  ๋‚œ์ œ๋ฅผ ํ•ด๊ฒฐํ•˜๊ณ , ์—…๋ฌด ํšจ์œจํ™” ๋ฐ ์ƒ์‚ฐ์„ฑ ํ–ฅ์ƒ, ์ œํ’ˆ ๊ธฐ๋Šฅ ๊ฐœ์„ ์„ ์ถ”์ง„ํ•ฉ๋‹ˆ๋‹ค.

๊ทธ ์ค‘์—์„œ๋„ Agentic AI Tech Cell์€ ์ œ์กฐ, ๋ฌผ๋ฅ˜ ํ˜„์žฅ์˜ ๋ณต์žกํ•œ ์˜์‚ฌ๊ฒฐ์ • ๋ฌธ์ œ๋ฅผ, ์ž์—ฐ์–ด ๋ช…์„ธ์™€ ์šด์˜ ๋ฐ์ดํ„ฐ๋กœ๋ถ€ํ„ฐ ์‹คํ–‰ ๊ฐ€๋Šฅํ•˜๊ณ  ๊ฒ€์ฆ ๊ฐ€๋Šฅํ•œ ์ฝ”๋“œ๋กœ ํ’€์–ด๋‚ด๋Š” code agent๋ฅผ ์—ฐ๊ตฌํ•ฉ๋‹ˆ๋‹ค.
์ˆ˜์š”์˜ˆ์ธก, ์žฌ๊ณ ๊ด€๋ฆฌ, ์ƒ์‚ฐ๊ณ„ํš, ์‹œ๋ฎฌ๋ ˆ์ด์…˜ ๊ฐ™์€ ๊ณผ์ œ๋ฅผ ๋Œ€์ƒ์œผ๋กœ ํ™˜๊ฒฝ ์ž๋™ ์ƒ์„ฑ, tool-use, verifiable reward ๊ธฐ๋ฐ˜์˜ agentic post-training์„ ํ†ตํ•ฉํ•ด, agent๊ฐ€ ์‹ค์ œ ์‚ฐ์—… ์›Œํฌํ”Œ๋กœ์šฐ์—์„œ ์‹ ๋ขฐํ•  ์ˆ˜ ์žˆ๋Š” ๊ฒฐ๊ณผ๋ฅผ ๋‚ด๋„๋ก ๋งŒ๋“œ๋Š” ๊ฒƒ์ด ๋ชฉํ‘œ์ž…๋‹ˆ๋‹ค.


์ˆ˜ํ–‰ ์—…๋ฌด

Research on Industrial Code Agents & RL Environments

  • Code Agent for Industrial Decision Automation: ๋ฌธ์ œ ๋ช…์„ธ, ๋ฐ์ดํ„ฐ, ์ œ์•ฝ ์กฐ๊ฑด์œผ๋กœ๋ถ€ํ„ฐ ํ™˜๊ฒฝ, ์ •์ฑ…, ํ‰๊ฐ€, ๊ฒ€์ฆ ์ฝ”๋“œ๋ฅผ ์ƒ์„ฑํ•˜๊ณ  ์‹คํ–‰ํ•˜๋Š” code agent ์—ฐ๊ตฌ
  • RL Environment & Simulator Generation: ์ œ์กฐ, ๋ฌผ๋ฅ˜ ์˜์‚ฌ๊ฒฐ์ • ๋ฌธ์ œ๋ฅผ ์œ„ํ•œ ์‹คํ–‰ ๊ฐ€๋Šฅ ํ™˜๊ฒฝ, ์‹œ๋ฎฌ๋ ˆ์ดํ„ฐ, ํ‰๊ฐ€ benchmark ์ž๋™ ์ƒ์„ฑ ์—ฐ๊ตฌ
  • Verifiable Reward & Agentic Post-training: ์‹คํ–‰ ๊ฐ€๋Šฅ์„ฑ, ์ œ์•ฝ ๋งŒ์กฑ, ๊ฒฐ๊ณผ ์ผ๊ด€์„ฑ ๋“ฑ ๊ฒ€์ฆ ๊ฐ€๋Šฅํ•œ ์‹ ํ˜ธ๋ฅผ ํ™œ์šฉํ•œ RLVR/RLHF ๊ธฐ๋ฐ˜ LLM agent post-training ์—ฐ๊ตฌ
  • Feedback-driven Code Agent Improvement: ์‹คํ–‰ ๋กœ๊ทธ, ์‹คํŒจ ์‚ฌ๋ก€, ์‚ฌ์šฉ์ž ์ˆ˜์ • ์ฝ”๋“œ, ํ‰๊ฐ€ ๊ฒฐ๊ณผ๋ฅผ ํ™œ์šฉํ•ด code agent์˜ cross-task ์„ฑ๋Šฅ์„ ๊ฐœ์„ ํ•˜๋Š” ์—ฐ๊ตฌ

ย 

์ง€์›์ž๊ฒฉ

  • ์ปดํ“จํ„ฐ๊ณตํ•™, ์ „๊ธฐ์ „์ž, ์‚ฐ์—…๊ณตํ•™, ์‘์šฉ์ˆ˜ํ•™ ๋“ฑ ๊ด€๋ จ ๋ถ„์•ผ์˜ ์„์‚ฌ/๋ฐ•์‚ฌ ๊ณผ์ • ์žฌํ•™ ๋ฐ ์†Œ์ง€ ๋˜๋Š” ์ด์— ์ค€ํ•˜๋Š” ์—ฐ๊ตฌ ๊ฒฝํ—˜ ๋ณด์œ 
  • LLM, RL, agent, code generation ์ค‘ ํ•˜๋‚˜ ์ด์ƒ์˜ ๋ถ„์•ผ์—์„œ ์—ฐ๊ตฌ ๋˜๋Š” ํ”„๋กœ์ ํŠธ ์ˆ˜ํ–‰ ๊ฒฝํ—˜ ๋ณด์œ 
  • ์ฃผ์š” ML/NLP/RL ํ•™ํšŒ (NeurIPS, ICML, ICLR, ACL, EMNLP ๋“ฑ) ๋…ผ๋ฌธ ๊ฒŒ์žฌ ๊ฒฝํ—˜ ๋ณด์œ ย 

ย 

์šฐ๋Œ€์‚ฌํ•ญ

  • LLM/RL/Code Agent ์—ฐ๊ตฌ ๊ฒฝํ—˜: RLVR, GRPO, RLHF, SFT, program synthesis, code-level editing, tool-use agent ํ‰๊ฐ€ ๊ฒฝํ—˜ ๋ณด์œ ย 
  • Agent ํ™˜๊ฒฝ, ๊ฒ€์ฆ ์ธํ”„๋ผ ๊ฒฝํ—˜: Gymnasium/PettingZoo, simulator benchmark, sandboxed execution, unit test, constraint checker, executable reward ์„ค๊ณ„ ๊ฒฝํ—˜ ๋ณด์œ ย 
  • ์ œ์กฐ, ๋ฌผ๋ฅ˜, SCM ๋„๋ฉ”์ธ ๊ฒฝํ—˜: ์ˆ˜์š”์˜ˆ์ธก, ์žฌ๊ณ ๊ด€๋ฆฌ, ์ƒ์‚ฐ๊ณ„ํš, planning/scheduling, simulation, optimization ๊ด€๋ จ ๊ฒฝํ—˜ ๋ณด์œ 
  • ๋Œ€๊ทœ๋ชจ LLM ์‹คํ—˜, ์šด์˜ ๊ฒฝํ—˜: verl, TRL, OpenRLHF, vLLM, SGLang, Docker/Kubernetes, on-prem GPU ํ™˜๊ฒฝ ๊ฒฝํ—˜ ๋ณด์œ 

ย 

์ „ํ˜•์ ˆ์ฐจ

  • ์„œ๋ฅ˜์‹ฌ์‚ฌ โ†’ ์ฝ”๋”ฉํ…Œ์ŠคํŠธ&LG Way Fit Test(์ธ์„ฑ๊ฒ€์‚ฌ) โ†’ Technical Interview(์˜จ๋ผ์ธ) โ†’ย  ์ตœ์ข… ํ•ฉ๊ฒฉ

ย  ย  ย  ย  ย  * ์ „ํ˜• ์ ˆ์ฐจ๋Š” ๋ณ€๊ฒฝ๋  ์ˆ˜ ์žˆ์Šต๋‹ˆ๋‹ค. ์„œ๋ฅ˜ ํ•ฉ๊ฒฉ ์‹œ ์ „ํ˜• ์ ˆ์ฐจ์— ๋Œ€ํ•ด ๋ณ„๋„๋กœ ์•ˆ๋‚ด ํ•ด ๋“œ๋ฆฝ๋‹ˆ๋‹ค.


ํ˜„์žฌ LG AI์—ฐ๊ตฌ์›์€ ๋ณ‘์—ญ์ง€์ •์—…์ฒด๊ฐ€ ์•„๋‹ˆ๋ฏ€๋กœ, ์ „๋ฌธ์—ฐ๊ตฌ์š”์› ์ฑ„์šฉ ๋ฐ ์ „์ง์ด ๋ถˆ๊ฐ€ํ•จ์„ ์•Œ๋ ค๋“œ๋ฆฝ๋‹ˆ๋‹ค.
์ง€์› ์‹œ ๋ฌธ์ œ๊ฐ€ ์žˆ์„ ๊ฒฝ์šฐcareers@lgresearch.ai ๋กœ ๋ฌธ์˜ ๋ถ€ํƒ๋“œ๋ฆฝ๋‹ˆ๋‹ค.

ย 

Research Scientist Internship(Agentic AI) ยท LG AI Research

Auto apply with Likeremote