씽크포비엘, 학습데이터 중복·맥락적 편향 진단 기술 소개
씽크포비엘이 10월 7일 AI 페스타에서 학습데이터의 중복·편향을 분석하는 솔루션 ‘리인’을 소개했다. 데이터에 오류가 없어도 특정 유형이 과도하거나 실제 사용 환경을 반영하지 못하면 판단이 왜곡될 수 있다는 설명이다. 모델 학습 전 데이터 점검과 공공기관의 AI 도입 검증에 활용할 수 있다고 밝혔다.
회사는 이미지 5만장과 2000장으로 각각 학습한 AI를 비교하는 사례를 전시했지만, 기사에는 구체적인 성능 점수가 제시되지 않았다.
리인은 데이터의 편향성과 중복을 분석하며, 데이터 구성과 실제 운용 환경 사이의 차이를 맥락적 편향으로 살핀다.
경찰청과 AI 신뢰성 사업을 진행했고 국방기술품질원과 세 차례 협력했으며, 국제표준과 연계한 검증 사업을 확대할 계획이다.
학습데이터를 늘리기 전에 실제 사용 환경에서 필요한 사례가 고르게 포함됐는지 점검하는 데 초점을 둔다.
원문
- "AI 데이터, 많다고 좋은 게 아냐"…씽크포비엘, 데이터 편향 잡는다ZDNet Korea · 원문 2026-10-07