
Kakao
Multimodal LLM Research Engineer (경력)
職種機械学習
経験ミドル級
勤務地Seongnam, Gyeonggi, South Korea
勤務オンサイト
雇用正社員
掲載5ヶ月前
ポジションについて
조직 소개
Multimodal Model Training 팀은 카카오의 자체 멀티모달 언어모델인 Kanana 시리즈를 연구·개발하는 조직입니다.
우리는 이미지-텍스트를 이해하는 Kanana-v(비전 언어모델), 오디오/텍스트 입출력이 가능한 Kanana-a(오디오 언어모델), 그리고 다양한 모달리티의 입출력을 통합하는 Kanana-o(멀티모달 통합 언어모델)을 개발하고 있습니다.
궁극적으로는 어떤 형태의 입력과 출력 간에도 자유롭게 상호 이해가 가능한 범용 멀티모달 모델을 만들기 위해, 국내외 최신 연구 동향을 빠르게 분석하고 이를 바탕으로 기술 선도 수준의 모델 경쟁력을 확보하는 것을 목표로 합니다.
연구부터 프로덕트 적용까지 기술 전 과정에 대해 함께 고민하고, 주도적으로 추진해 나갈 분을 기다립니다.
업무 내용
- 이미지·오디오·텍스트 등 다양한 모달리티를 다루는 Multimodal LLM 기반 서비스 특화 모델 개발
- SFT(Supervised Fine-tuning) 및 Off-policy/On-policy RL을 통한 서비스 성능 고도화
- 대규모 분산 학습 환경에서의 학습 코드 개발 및 성능 최적화
- 멀티모달 학습을 위한 고품질 데이터 수집, 전처리, 정합성 확보 및 데이터 구축 파이프라인 설계
- 멀티모달 모델 평가 지표 설계 및 벤치마킹, 실사용 시나리오 기반 성능 검증
지원 자격 및 우대사항
- 딥러닝 이론과 모델 개발에 대한 깊은 이해와 실무 경험 보유하신 분
- Py Torch, Tensor Flow, JAX 등 주요 딥러닝 프레임워크 중 하나 이상에 대한 활용 경험이 있으신 분
- Python 기반의 코드 개발 및 실험 구현에 능숙하신 분
- 딥러닝 관련 분야 석사 또는 박사 학위, 또는 이에 준하는 관련 경력 2년 이상을 보유하신 분
◆ 우대사항
- Multimodal LLM 기술 및 관련 서비스 개발 경험이 있으신 분
- CVPR, NeurIPS, ICLR, ICCV, ICML 등 AI 분야 최상위 학회 논문 발표 또는 공동 연구 경험이 있으신 분
- ACM ICPC 등 주요 프로그래밍 대회 수상 경력 또는 이에 준하는 알고리즘 역량을 보유하신 분
영입 절차
서류전형(CV 첨부 필수) > 코딩테스트 > 사전인터뷰 > 1차 인터뷰(사전과제) > 2차 인터뷰 > 처우 협의 > 최종 합격 및 입사
※ 지원서 제출 시 CV는 '포트폴리오' 란에 첨부해주시면 됩니다.
※ 영입 진행 상황에 따라 전형이 추가/변경될 수 있습니다.
크루 코멘트
- 우리는 자율성과 책임감을 바탕으로 함께 일하는 문화를 만들어갑니다.
- 회사의 공통 원칙을 존중하면서도, 개인의 몰입과 팀의 효율을 극대화할 수 있는 방식으로 유연하게 일합니다.
- 불필요한 보고나 형식보다 실질적인 성과와 성장에 집중하며, 스스로 목표를 세우고 실행하는 과정을 중요하게 생각합니다.
- 지속적인 기술 공유와 수평적인 커뮤니케이션을 통해 함께 배우고 성장하는 문화를 만들어갑니다.
연구부터 프로덕트 응용까지, 기술의 전 과정을 함께 고민하고 주도해 나갈 열정적인 분들을 기다립니다.
福利厚生
•健康保険
•退職金制度
•有給休暇
必須スキル
Machine learning
Model evaluation
Data workflows
Kakaoについて
판교
本社所在地