
< (왼쪽부터) 문화기술대학원 박주용 교수, 이원재 교수, 노준용 교수 >
우리 대학은 KBS(사장 양승동)와 함께 한국형 보도영상 인공지능(AI) 데이터베이스와 메타데이터 구축에 나선다고 20일 밝혔다.
문화기술대학원 박주용(과제총괄책임), 이원재, 노준용 교수 연구팀이 주도하는 컨소시엄은 인공지능을 이용해 영상 정보 추출과 편집을 손쉽게 하는 기술 개발에 착수했다. 이와 함께 수행기관인 KBS가 보유한 방대한 뉴스 영상 데이터를 결합해 포스트 코로나 시대 인공지능 기반 영상 콘텐츠 산업 창출에 적극적으로 나설 계획이라고 밝혔다.
현재 인공지능은 질병 진단과 자율운전 등 인간의 기계적인 움직임과 판단력을 보완하는 영역을 벗어나 미디어 콘텐츠 제작과 같은 창의적 분야까지 급속히 확장하고 있다. 하지만 비전문가 누구라도 말을 통해 손쉽게 콘텐츠를 만들고 편집할 수 있게 하는 인공지능 기술은 아직 많은 발전이 필요하며 우리나라에서는 특히 한국어 기반 데이터 세트의 부족이 큰 걸림돌이 되고 있다고 전문가들은 입을 모으고 있다.
우리 대학은 KBS와 함께 인공지능 모델 학습을 위한 고품질의 영상 데이터를 구축하고 ‘한국형 뉴스 영상 메타데이터 표준 모델’ 개발을 목표로 하고 있다. 메타데이터 기반 공공개방형 뉴스 아카이브 분야는 현재 미국의 AP와 영국의 BBC가 주도하고 있는데, 박주용 교수는 “이 프로젝트를 통해 저작권 문제와 범용성 메타데이터의 부족으로 연구 개발에 어려움을 겪던 연구자들과 관련 스타트업들의 숨통이 트일 것으로 기대한다”며 “더 나아가 한국형 콘텐츠 플랫폼의 틀을 다지게 될 것”이라고 밝혔다.

< 인공지능 학습용 데이터 구축 예시1 >

< 인공지능 학습용 데이터 구축 예시2 >
과기정통부(장관 임혜숙)와 한국지능정보사회진흥원(원장 문용식)의 `2021년도 인공지능 학습용 데이터 구축' 사업 예산 및 KAIST가 주도하는 컨소시엄의 민간투자금 등 모두 42억 원의 재원으로 운용되는 이 과제는 우리 대학 문화기술대학원이 주관하고 KBS, 메트릭스리서치(대표 나윤정), 액션파워(공동대표 조홍식/이지화), 소리자바(대표이사 안상현), 데이터메이커(대표이사 김태헌), 미소정보기술(대표이사 안동욱), 인터마인즈(대표이사 김종진)가 공동연구기관으로 참여한다. 이 프로젝트에서 개발되는 데이터베이스, 인공지능 학습모델, 프로그래밍 코드 등 모든 연구 결과는 공공재이기 때문에 누구나 연구와 사업에 사용할 수 있다.

< 응용 서비스 예시 >
“사람처럼 판단하는 로봇, 생각보다 빨리 온다.” 로봇이 인간의 의도를 이해하고 스스로 올바른 행동을 선택하는 시대를 앞당길 핵심 기술이 국내에서 나왔다. KAIST 연구진이 단 몇 개의 영상만으로 AI가 인간의 판단 기준을 스스로 학습하는 기술을 개발하며 피지컬 AI 상용화의 핵심 난제를 해결했다. 우리 대학은 전기및전자공학부 유창동 교수 연구팀이 수천~수만 건의 인간 평가 데이터 대신 단 몇 개의 선호 영상만으로도 AI가 인간의 의도와 판단 기준을 학습할 수 있는 새로운 기술인 ‘VOTP(Video-based Optimal TransPort Preference)’를 세계 최초로 개발했다고 10일 밝혔다. 연구팀의 논문은 오는 7월 서울 코엑스에서 개최되는 세계 최고 권위의 AI학회인 ICML(International Conference on Machine Learning) 2026에 채택됐으며, 전체 제출 논문(23,918편
2026-06-10우리 대학은 메타버스대학원이 오는 6월 10일부터 12일까지 서울 코엑스에서 열리는 ‘가상융합산업대전(KMF: Korea Metaverse Festival) 2026’에 참가해 현실 공간을 인식·이해하고 사람과 사물의 위치·움직임·상황을 분석해 상호작용할 수 있도록 하는 ‘차세대 공간 AI(Spatial AI)’와 XR(확장현실) 분야 핵심 연구 성과를 공개한다고 5일 밝혔다. 이번 성과는 과학기술정보통신부와 정보통신기획평가원(IITP)이 미래 핵심 산업 대응을 위해 추진해 온 정보통신방송혁신인재양성사업‘가상융합대학원 사업’의 대표적 성과로 평가된다. KAIST 메타버스대학원은 올해 열린 세계 최고 권위의 가상현실(VR) 학술대회인 ‘IEEE VR 2026’에서 세계 대학·연구기관 가운데 두 번째로 많은 12편의 구두 논문을 발표하며 글로벌
2026-06-04우리 대학은 1일 오전 10시 KAIST 학술문화관(E9) 5층 정근모컨퍼런스홀에서 ‘KAIST AI대학 비전선포식’을 개최했다. 이번 행사는 AI 시대를 선도할 핵심 인재 양성과 교육·연구 혁신, 산업 협력, 책임 있는 AI 생태계 구축을 위한 비전과 추진 방향을 대내외에 공유하기 위해 마련됐다. KAIST AI대학은 인공지능을 단순한 활용 도구가 아닌 과학기술, 산업, 교육, 사회 전반의 변화를 이끄는 새로운 지식 생산의 기반으로 보고 있다. 이에 따라 AI 핵심 기술을 선도할 연구 인재와 다양한 분야에서 AI를 창의적으로 활용할 융합 인재를 함께 양성하고, 모델·알고리즘·시스템·인프라·도메인 융합은 물론 미래 사회 설계와 책임 있는 AI까지 포괄하는 교육·연구 체계를 구축해 나갈 계획이다. 비전선포식은 이광형 KAIST 총장의 환영사로 시작됐다. 이어 배경훈 부총리 겸 과학
2026-06-01챗GPT와 같은 거대언어모델(LLM·Large Language Model) 서비스를 운영하려면 수만 대 규모의 서버 인프라가 필요하다. 하지만 새로운 AI 반도체나 시스템 구조를 검증할 때마다 실제 장비를 구축하는 데에는 막대한 비용과 시간이 소요된다. 우리 대학 연구진은 실제 대규모 AI 서버를 구축하기 전에 컴퓨터 안에서 성능과 효율을 미리 검증할 수 있는 ‘가상 실험장’을 개발했다. 우리 대학은 전산학부 박종세 교수 연구팀이 개발한 거대언어모델(LLM) 서비스 인프라 시뮬레이터(simulator·가상 실험 소프트웨어) 연구가 컴퓨터 시스템 성능 분석 분야의 세계적 권위 학회인 ‘ISPASS 2026(IEEE International Symposium on Performance Analysis of Systems and Software)’에서 최우수 논문상을 수상했다고 29일 밝혔다. 연구팀이 개발한 &l
2026-05-29영화 ‘쥬라기 공원’에서 거대한 공룡이 걸어오는 장면을 보면 사람들은 자연스럽게 땅이 울리는 듯한 묵직한 저주파음을 떠올린다. 이는 인간이 단순히 사물의 형태뿐 아니라 크기와 무게, 움직임의 속도 같은 물리적 특성까지 함께 고려해 소리를 예측하기 때문이다. 하지만 기존 영상-음향 생성 AI는 화면 속 사물의 형태나 장면 정보에 주로 의존해 소리를 생성해, 무게나 속도에 따라 달라지는 물리적 특성까지는 충분히 반영하지 못했다. 우리 대학은 전산학부 오태현 교수 연구팀이 POSTECH(총장 김성근), 소니 AI(Sony AI) 공동 연구진과 함께 영상 속 물리적 상황을 이해해 보다 현실감 있는 소리를 생성하는 인공지능(AI) 기술 ‘파바스(PAVAS·Physics-Aware Video-to-Audio Synthesis)’를 개발했다고 26일 밝혔다. 이번 기술의 핵심은 영상 속 물체의 질량과 속도 등 눈에 보이지 않는 물
2026-05-27