“이미지 속 한국, AI가 읽는다” …
KETI, 한국 문화유산·한글 특화 AI 모델 개발
- 한국의 문화유산과 한글 이해도 높인 AI 모델 ‘HAECHI 2종’ 공개 -
- 검색·예약·구매 등 복합 작업 수행 능력까지 갖춰 -

□ 한국전자기술연구원(원장 노건기, 이하 KETI)이 이미지 속 한글과 한국의 문화유산을 정확하게 식별해 내고, 여러 가지의 웹과 앱(app)을 통한 예약이나 구매 등 사용자가 요구하는 복잡한 작업을 처리해 주는 AI 모델 ‘HAECHI(해치)' 2종을 개발했다고 밝혔다.
ㅇ HAECHI는 이미지와 텍스트를 함께 처리하는 AI 모델로 사용자의 질문과 첨부된 이미지를 동시에 분석해 주며, 티켓 발권이나 상품 구매·환불, 서비스 가입과 같이 여러 단계를 거쳐야 하는 작업도 수행할 수 있다.
□ KETI AI기반모델연구센터의 자연어처리 연구팀은 외산 언어모델이 한글과 한국의 문화유산을 제대로 식별하지 못하며 장기 작업을 수행하는 능력이 부족한 것에 주목하여 기존 모델(HyperCLOVA X와 Qwen3.5)에 한국의 사물·문화유산 이미지, 한글 간판과 공공 문서 등의 학습 데이터를 추가 학습시켜 본 모델을 구축했다.
□ 연구팀이 개발한 모델은 이미지 속 한글과 한국의 문화유산을 높은 정확도로 식별해 내고, 복잡한 작업 처리 능력을 높였다.
ㅇ 연구팀이 자체 구축한 평가셋 H400(400개의 한국 문화유산 대상)을 바탕으로 성능을 평가한 결과, 문화유산의 정식 이름을 정확히 맞힌 비율이 각각 0.92%에서 38.07%로(Qwen3.5 모델), 5.05%에서 74.16%(HyperCLOVA X 모델)로 향상됐다.
ㅇ 거리 사진 속 한글 간판을 읽어내는 능력도 두 모델 모두에서 5%포인트 이상 향상됐다.
* Qwen3.5 기반 모델은 36.13%에서 41.41%로, HyperCLOVA X 기반 모델은 33.59%에서 38.87%로 성능 향상.
ㅇ 앞 단계 작업 결과를 보고 다음에 무엇을 해야 할지 판단하는 장기 작업 수행 능력도 강화해, 관련 평가(Tau2)에서 두 모델 모두 약 2%포인트씩 종합 점수가 올랐다.
□ 연구팀은 정보통신산업진흥원(NIPA)의 ‘첨단 GPU 활용 지원 사업’으로 GPU 자원을 지원받아 본 모델을 개발하고, 정보통신기획평가원(IITP)이 지원하는 ‘사람중심 인공지능 핵심원천기술 개발 사업’의 과제*를 통해 한국 문화유산 데이터셋을 구축했다.
* 과제명 : 상황인지 및 사용자 이해를 통한 인공지능 기반 1:1 복합대화 기술 개발
□ 김정호 KETI AI기반모델연구센터장은 “한국의 문화와 언어를 잘 이해하는 AI를 통해 세계에 한국을 제대로 알릴 수 있을 것”이라며 “이번에 구축한 한국 특화 데이터로 독자 파운데이션 모델 생태계 조성에 기여하고, HAECHI를 한국형 AI 에이전트 기술로 발전시키겠다”라고 밝혔다.
□ KETI의 HAECHI 모델 2종에 관한 모델 파일과 평가 결과, 실행 방법은 허깅페이스에서 확인할 수 있다.*
* Qwen3.5-KETI-HAECHI-27B : https://huggingface.co/KETI-NLP/Qwen3.5-KETI-HAECHI-27B
* HyperCLOVA-X-KETI-HAECHI-32B : https://huggingface.co/KETI-NLP/HyperCLOVA-X-KETI-HAECHI-32B










