시행 중과학기술정보통신부
독자 AI 파운데이션 모델 프로젝트 데이터 개방
과학기술정보통신부와 한국지능정보사회진흥원(NIA)이 '독자 AI 파운데이션 모델' 프로젝트 5개 정예팀이 구축한 AI 학습용 데이터 29종, 3544만 건을 AI허브에 무료 공개한다. 네이버클라우드, 업스테이지, SK텔레콤, NC AI는 품질검증 등을 거친 데이터 전체를 개방하고, LG AI연구원은 의무개방량인 50% 이상을 통계적으로 선별해 공개한다.
- 발표
- 2026-08-27
- 시행
- —
- 예산
- 150억
설계 완성도
52/ 100배점 65점어치 확인
실행 확신도
100/ 100
시행 중 단계에서 나온 값입니다
항목별
- 목표 명확성3/10
- 근거 수준10/15
- 실행 구체성6/15
- 성과 측정 가능성10/10
- 수혜 범위5/5
- 부작용 대응0/10
- 재원 확실성확인 불가
- 법적 확실성확인 불가
- 지속가능성확인 불가
재원 확실성, 법적 확실성, 지속가능성은(는) 아직 확인할 수 없어 배점에서 뺐습니다. 0점을 준 것이 아닙니다 — 예산·법령 자료를 연결하면 채워집니다.
목표
숫자와 기한이 적힌 것만 목표로 셉니다. “경쟁력을 강화한다”는 방향이지 목표가 아닙니다 — 나중에 달성 여부를 물을 수 없기 때문입니다.
- 개방 데이터 수3,544만 건
- 개방 데이터 종류29종
- 개방 데이터 규모15,600억 토큰
- 데이터 구축·가공 예산150억 원
예상 영향
이건 예측입니다. 시간이 지나면 실제와 대조해 이 판단이 맞았는지 채점합니다. 확신도가 낮은 것은 낮게 적었다는 뜻이지 영향이 작다는 뜻이 아닙니다.
- 인터넷+40M12 · 확신 0.72AI 학습용 데이터가 무료 개방되어 AI 모델 개발과 서비스 고도화에 활용될 수 있다고 문서에 적혀 있다.
- 035420+35M12 · 확신 0.70NAVER클라우드가 공개 데이터 구축 주체로 적혀 있다.
- 036570+30M12 · 확신 0.68NC AI가 데이터 구축 주체로 적혀 있다.
- 게임+20M12 · 확신 0.55NC AI가 구축한 데이터가 LLM 핵심 역량 및 산업 현장 활용에 쓰일 수 있다고 적혀 있으나 게임 산업 직접 대상은 아니다.
- 035720+20M12 · 확신 0.55인터넷 플랫폼 기업으로서 AI 데이터 개방의 간접 수혜 가능성이 있으나 문서상 직접 대상은 아니다.
진행
- 발표2026-08-27
- →시행 중2026-08-27
- →시행 준비2026-08-27
근거 문서
위의 모든 판단은 이 문서들에서 나왔습니다. 언론 보도가 아니라 정부가 직접 낸 자료만 씁니다.
- '독파모' 정예팀 데이터 3544만 건 개방…'AI허브'서 무료2026-08-27