우리 대학 기계공학과 윤국진 교수 연구팀이 세계적인 컴퓨터 비전 국제학술대회인 ECCV 2026(European Conference on Computer Vision)에서 총 13편의 논문을 채택시키며, 국제적으로 높은 연구 역량을 다시 한번 입증했다.

< ECCV 2026 (스웨덴 말뫼) >
ECCV는 CVPR, ICCV와 함께 컴퓨터 비전 분야의 3대 학술대회로 꼽히며, 1990년부터 격년으로 개최되어 온 대표적인 국제학술대회이다. 이번 ECCV 2026에는 전 세계에서 총 10,473편의 논문이 제출되었고, 이 가운데 2,883편만이 채택되어 약 27.5%의 채택률을 기록하였다. 이처럼 치열한 경쟁 속에서 단일 연구실이 13편의 논문을 채택시킨 것은 매우 주목할 만한 성과이다.
이번에 채택된 논문들은 자율주행, 공간지능, 생성형 비전, 이벤트 카메라, 비전-언어 학습, 데이터셋 증류 등 컴퓨터 비전 분야의 주요 연구 흐름을 폭넓게 아우르고 있다. 특히 자율주행 분야에서는 차량이 주변 환경을 이해하고, 인프라와 협력하며, 예측과 계획을 통합해 보다 안전하고 지능적인 주행을 수행하기 위한 연구들이 포함되었다. 또한 악천후, 센서 불확실성, 데이터 부족 등 실제 도로 환경에서 발생할 수 있는 문제를 해결하기 위한 센서 융합 및 주행 장면 생성 연구도 함께 발표되었다.
공간지능과 생성형 비전 분야에서는 영상으로부터 3차원 및 4차원 장면을 이해하고 복원하며, 새로운 시점을 생성하거나 장면의 움직임과 외형을 편집하는 연구들이 포함되었다. 이는 자율주행, 로보틱스, 가상환경 생성 등 다양한 실제 응용 분야로 확장될 수 있는 핵심 기술이다.
이와 함께 이벤트 카메라 기반 고속 시각 인식, 대규모 언어 모델을 활용한 인간 움직임 예측, 비전-언어 모델 기반 의미 이해, 데이터셋 증류와 지속적 테스트 시간 적응 등 차세대 비전 AI 모델의 성능과 활용성을 높이기 위한 연구들도 함께 다루었다. 이번 성과는 윤국진 교수 연구팀이 자율주행과 로보틱스에 필요한 실제 지능 시스템부터 3차원 공간지능, 생성형 비전, 비전-언어 모델에 이르기까지 폭넓은 연구를 활발히 수행하고 있음을 보여준다.
윤국진 교수 연구팀은 지난해 ICCV 2025에서 12편, 올해 CVPR 2026에서 10편의 논문을 발표한 데 이어, 이번 ECCV 2026에서도 13편의 논문을 채택시키며 컴퓨터 비전 분야에서 세계적으로도 보기 드문 연구 성과를 이어가고 있다. CVPR, ICCV, ECCV는 컴퓨터 비전 분야를 대표하는 최상위 국제학술대회로, 이들 학회에서 매년 두 자릿수 논문을 연속적으로 발표하는 것은 국제적으로도 매우 이례적인 성과이다. 이번 결과는 윤국진 교수 연구팀이 자율주행, 로보틱스, 공간지능, 생성형 비전, 비전-언어 모델 등 주요 연구 분야에서 세계적 수준의 경쟁력을 갖추고 있음을 보여준다. 연구팀은 앞으로도 실제 환경에서 활용 가능한 시각지능 기술과 차세대 인공지능 모델을 중심으로 기존 기술의 한계를 넓히는 도전적인 연구를 지속할 계획이다.
한편, ECCV 2026은 오는 9월 8일부터 12일까지 스웨덴 말뫼에서 개최될 예정이다.
생물학 연구에 사용되는 형광 현미경이나 반도체 산업에 사용되는 주사전자현미경의 공통점은 불안정성으로 인해 흐려진 영상(블러, blur)을 보정하는 과정이 반드시 필요하다는 점이다. 우리 연구진이 굉장히 강한 잡음에 의해 손상된 왜곡 영상에 대해 적응형 필터와 생성형 인공지능 모델을 융합해 영상을 복원하는 데 성공했다. 우리 대학 바이오및뇌공학과 장무석 교수 연구팀이 삼성전자 DS부문 반도체연구소 차세대공정개발실과 공동 연구를 통해 왜곡 및 강한 잡음이 존재하는 의료·산업 영상을 복원하는 기술을 개발했다고 26일 밝혔다. 스마트폰 카메라 사진에 영상의 흐림·왜곡이 생겼을 때 보정하는 문제를 디컨볼루션(deconvolution) 또는 디블러링(deblurring)이라고 하며, 흐려진 영상 정보만 이용해 선명한 영상을 복원하는 기술을 블라인드 디컨볼루션(blind deconvolution)이라고 한다. 흥미롭게도 디컨볼루션 문제는 일상뿐만 아니라 생물학
2024-11-26우리 대학 기계공학과 윤국진 교수 연구팀의 논문 12편이 세계 최고 권위 컴퓨터비전 국제학술대회 중 하나인 ECCV 2024 (European Conference on Computer Vision)에 채택되어, 컴퓨터 비전 분야 세계 최고의 연구 역량을 다시 한번 인정받았다. CVPR, ICCV와 함께 컴퓨터 비전 분야 뿐 아니라 전체 인공지능 분야에서도 세계 최고 권위 학술대회로 꼽히는 ECCV는 1990년부터 격년으로 개최되는 학술대회로, Google Scholar 기준 H5-색인 206을 기록하고 있으며, 공학 및 컴퓨터과학 (Engineering & Computer Science)전분야에서 최고 수준의 국제 학술대회 중 하나이다. 이번 ECCV 2024에는 총 8,585개의 논문들이 제출되었고 그 중 2,395개의 논문이 채택되어 약 27.9%의 낮은 채택률을 기록하였다. 단일 연구실에서 12편의 논문이 채택된 것은 극히 이례적인 경우다. 윤국진 교수 연구팀의
2024-08-29챗GPT와 같은 거대 언어 모델의 근간이 되는 트랜스포머로 구축된 기존 비디오 모델보다 8배 낮은 연산량과 4배 낮은 메모리 사용량으로도 높은 정확도를 기록했으며, 추론 속도 또한 기존 트랜스포머 기반 모델 대비 4배의 매우 빠른 속도를 달성한 동영상 인식기술이 우리 연구진에 의해 개발됐다. 우리 대학 전기및전자공학부 김창익 교수 연구팀이 초고효율 동영상 인식 모델 ‘비디오맘바(VideoMamba)’를 개발했다고 23일 밝혔다. 비디오맘바는 기존 트랜스포머 기반 모델들이 가지고 있는 높은 계산 복잡성을 해결하기 위해 설계된 새로운 동영상 인식 모델이다. 기존의 트랜스포머 기반 모델들은 셀프-어텐션(self-attention)이라는 메커니즘에 의존해 계산 복잡도가 제곱으로 증가하는 문제를 가지고 있었다. 김창익 교수 연구팀의 비디오맘바는 선택적 상태 공간 모델(Selective State Space Model, Selective SSM)* 메커니즘
2024-07-23멀티모달 대형 언어모델이란 텍스트뿐만 아니라 이미지 데이터 유형까지 처리할 수 있는 초대형 언어모델을 말한다. 해외 대형 기업의 풍부한 컴퓨팅 자원의 지원으로부터 인간의 뇌에 있는 신경망의 개수와 유사한 수준초대형모델들이 만들어지고 있으나 학계에서는 이런 개발이 쉽지 않았다. KAIST 연구진이 오픈AI의 GPT-4V와 구글의 제미나이-프로(Gemini-Pro)를 뛰어넘는 멀티모달 대형언어모델을 개발하여 화제다. 우리 대학 전기및전자공학부 노용만 교수 연구팀이 오픈AI(OpenAI)의 GPT-4V 등 기업에서 비공개하고 있는 상업 모델인 초대형 언어모델의 시각 성능을 뛰어넘는 공개형 멀티모달 대형 언어모델을 개발해 출시했다고 20일 밝혔다. 노용만 교수 연구팀은 단순히 모델의 크기를 키우거나 고품질의 시각적 지시 조정 데이터셋을 만들지 않고 멀티모달 대형언어모델의 시각 성능을 획기적으로 높인 콜라보(CoLLaVO), 모아이(MoAI) 2가지 기술을 연속적으로 개발했다고 밝
2024-06-20우리 대학이 스웨덴 왕립공과대학(KTH)과 ‘원자력 석사’ 분야 복수학위 제도를 운영한다. KAIST 원자력및양자공학과(학과장 임만성 교수)와 스웨덴 왕립공과대학 물리학과(학과장 구도우스키 교수)는 4일 교내 Faculty Club 회의실에서 ‘원자력 ․ 양자공학 석사 분야 복수학위 개설’을 내용으로 회의를 진행했다. 이번 학위과정 운영은 오는 가을학기부터 시작되며, 2014년 양 교의 기계공학과 간 체결된 공동석사학위 개설에 이은 두 번째다. 이번 협약에 따라 양 대학은 △ 원자력 분야 우수학생 상호 교환 △ 양교에서 일정학점 이수 시 복수학위 수여 △ 양교 교환학생 학비 전액면제 등의 분야에서 협력하기로 했다. KAIST는 이번 협력을 통해 원자력 분야의 교육과 연구에서 국제적인 시너지가 발생할 것으로 기대하고 있다. 한편, 1827년 설립된 스웨덴 왕립공과대학(KTH Royal Institute of Technology)은
2016-07-05