연구실 소개
Multimodal Intelligence Lab
작성자: 오재훈 (jaehoon.oh@pusan.ac.kr) · 작성일자: 2026. 09. 09
연구실 소개
MI Lab(Multimodal Intelligence Lab, 멀티모달 지능 연구실)은 시각(vision), 음성(speech) 및 음악(music)을 포함한 오디오(audio), 텍스트(text) 등 서로 다른 형태의 데이터를 함께 이해하고 연결하는 인공지능을 연구합니다. 여러 모달리티가 만날 때 드러나는 문제와 가능성에 폭넓게 관심을 두고 있습니다.
주요 연구 분야
- Multimodal AI: 이미지·영상·오디오와 텍스트를 함께 다루는 이해·생성 모델
- Agentic AI: 계획(plan)·실행(execute)·설명(explanation)이 가능한 에이전트
- AI+X: 산업·기후·신소재 등 다른 분야에 AI를 접목하는 응용 연구 (예: 이상 탐지)
- 그 외 새로운 모달리티·태스크로의 확장
연구실 운영 방식
- 코어타임(11시–4시) 준수 (오프라인)
- 지도교수와의 미팅 — 개인 연구 진행 상황, 프로젝트 진행 상황 공유
- 매주 돌아가며 Tech News 작성
FAQ
- Q. 들어가기 위해서 무엇을 공부해야 하나요?
정해진 전공 제한은 없지만, 아래 기초가 있으면 좋습니다.
- 수학: 선형대수·확률과 통계·미적분의 기본 개념
- 프로그래밍: Python 기반의 기본적인 코딩 능력
- 딥러닝: 신경망 학습 원리와 LLM(대규모 언어모델)을 포함한 기본 개념 (2026 Fall 고급딥러닝 7주차까지의 내용)
- AI 코딩 도구(예: Claude Code, Codex 등)를 활용할 수 있는 능력