Data-SSML (음성 합성 표기 지원)
이 페이지는 1EdTech의 원문 페이지를 한국어로 번역한 것입니다. 최신 내용은 원문을 확인하시기 바랍니다. 공식 원문 보기
Data-SSML
HTML의 음성 합성 지원
기술 개요 | 시작하기 | 참여하기 | 지원
학생이 화면 낭독기와 텍스트 음성 변환(TTS) 같은 소리 내어 읽기 기술을 사용할 때 평가와 학습 자원에 공평하게 접근할 수 있게 하는 일은, 디지털 자원을 저작하고 개발할 때 우선순위가 높은 과제다. 에듀테크 시장에서 AI와 다른 표준이 성장하고 있음에도, 특히 고부담 평가에서는 기계 판독 가능한 표준 형식이 여전히 필요하다.
1EdTech의 평가 및 접근성 전문가들은 W3C의 Speech Synthesis Markup Language(SSML) 표준을 활용하고 이를 확장해, HTML 콘텐츠를 마크업하는 텍스트 안에 지시를 추가하는 방법을 안내하는 새로운 표준 스펙을 만들 것을 제안했다. 이는 1EdTech QTI와 HTML 양쪽에 화면 낭독기를 위한 발음 단서를 제공한다. 1EdTech Support for Speech Synthesis Markup Language (SSML) Using the 'data-ssml' Property Version 1.0 스펙은 QTI® 3 표준과 HTML 양쪽의 평가 및 학습 콘텐츠에서 텍스트 음성 변환 도구가 텍스트를 올바르게 발음하도록 지시 단서를 추가하는 방법을 기술한다.
커뮤니티에서 「Data-SSML」이라는 별칭으로 불리는 이 표준은, JSON을 사용해 SSML 속성과 값을 감싸는 사용자 정의 data- 속성(data-ssml)을 정의해 보조 기술이 쉽게 소비할 수 있게 한다.
1EdTech의 Question & Test Interoperability(QTI)® 표준은 접근성 있는 시험, 문항, 학습 자원을 한 애플리케이션에서 다른 애플리케이션으로 안전하게 옮기도록 패키징해 이식 가능하게 만드는 방법이다. QTI 3 형식은 연방 접근성 요구사항(Section 508과 WCAG 2.1 AA)을 준수하며, 이 표준으로 만든 시험과 학습 자원이 능력과 무관하게 모두에게 접근 가능하도록 보장한다. 또한 애플리케이션 사이에서 표준화된 표시 일관성을 제공해 사용자 경험을 한층 높인다.
Data-SSML 스펙은 QTI 3 콘텐츠 및 애플리케이션과 함께 사용할 수 있는 추가 기술 안내로, QTI와 HTML 환경 양쪽에서 텍스트 음성 변환 단서를 구현할 때 도움이 된다.
이제 교육자, 교수 설계자, 개발자는 QTI 3과 HTML에서 TTS 도구가 텍스트를 올바르게 발음하도록 지시를 추가하는 표준 형식을 갖게 된다.
한국어 요약
개요
시험 문항을 소리로 들어야 하는 학생이 있다. 화면 낭독기나 텍스트 음성 변환(TTS) 도구가 문항을 읽어 주는데, 같은 글자가 문맥에 따라 다르게 읽혀야 하는 경우가 문제가 된다. 수학의 「2x」를 「이 엑스」로 읽을지 「두 배의 엑스」로 읽을지, 약어를 글자 그대로 읽을지 풀어 읽을지에 따라 문항의 의미가 달라진다. 도구마다 판단이 다르면 같은 시험이 학생마다 다른 시험이 된다. Data-SSML은 콘텐츠 저작자가 「이 텍스트는 이렇게 읽어야 한다」를 콘텐츠 안에 기계 판독 가능한 형태로 적어 두게 해, 도구가 달라도 같은 발음이 나오도록 한다.
기술 관점에서 Data-SSML은 새로운 음성 합성 언어를 만들지 않는다. W3C가 정의한 Speech Synthesis Markup Language(SSML)를 가져다 쓰되, 이를 HTML 안에서 전달할 방법을 정한다. 텍스트 컨테이너 요소에 data-ssml이라는 사용자 정의 data 속성을 붙이고, 그 값으로 SSML의 기능, 속성, 값을 JSON에 담는다. 보조 기술이 이 값을 읽어 발음과 표시 방식을 결정한다. QTI 3의 부속 스펙이며 현재 버전은 1.0이다.
핵심 개념
- SSML(Speech Synthesis Markup Language): W3C가 정의한 음성 합성 표기 언어. 발음, 강세, 끊어 읽기, 속도 같은 지시를 표현한다. Data-SSML은 이 어휘를 그대로 쓴다.
data-ssml속성: HTML의 사용자 정의 data 속성. 텍스트 컨테이너 요소에 붙어 그 텍스트를 어떻게 읽을지 지시한다.- JSON 바인딩:
data-ssml값의 표현 기술. SSML의 기능, 속성, 값을 JSON 객체로 감싼다. 스펙은 이 형식을 기계 판독 가능한 JSON-Schema로도 표현한다. - 텍스트 음성 변환(TTS): 텍스트를 소리로 바꾸는 기술. 소리 내어 읽기 도구와 화면 낭독기가 이에 해당한다.
- ASI 정보 모델: QTI 3의 Assessment, Section, and Item 정보 모델.
data-ssml속성의 정의가 여기에 포함되어, SSML 기반 처리기로 정보를 전달하는 경로가 규정된다.
구성 요소
Data-SSML 스펙이 정하는 것은 다섯 가지다. 첫째, data-ssml 속성으로 전달되는 데이터의 형식을 기술한다. 둘째, 허용되는 내용이 W3C SSML Version 1 스펙에서 파생된다는 점을 전제로 삼는다. 셋째, 속성 안에 허용되는 정보의 범위를 정의한다. 넷째, 그 정보의 기술 바인딩으로 JSON을 상정한다. 다섯째, JSON 형식을 정의하고 이를 기계 판독 가능한 JSON-Schema로 표현한다.
적용 대상은 두 곳이다. 하나는 QTI 3으로 작성된 평가 콘텐츠이고, 다른 하나는 일반 HTML 콘텐츠다. 같은 속성과 같은 값 형식을 두 환경에서 쓰기 때문에, 평가 문항에 붙인 발음 지시를 학습 자료에 그대로 옮길 수 있다.
문서 구성은 단일 스펙 문서(정보 모델 겸 바인딩)이며, QTI 3 전체 스펙 문서 묶음과 함께 참조하도록 되어 있다. 별도의 적합성 인증 문서는 이 스펙 단독으로 발행되지 않는다.
작동 방식
- 콘텐츠 저작자가 특별한 발음이 필요한 텍스트를 찾는다. 수식, 약어, 고유명사, 외래어가 대표적이다.
- 해당 텍스트를 감싸는 요소에
data-ssml속성을 붙인다. - 속성 값에 SSML의 기능, 속성, 값을 JSON으로 적는다. 어떻게 읽을지에 대한 지시가 여기에 들어간다.
- 콘텐츠가 QTI 3 평가 또는 HTML 학습 자료로 배포된다.
- 학생이 소리 내어 읽기 도구나 화면 낭독기를 켠다.
- 보조 기술이
data-ssml값을 읽어 SSML 지시대로 발음한다. 지시가 없는 텍스트는 도구의 기본 규칙대로 읽힌다.
국내 도입 시나리오
국내 평가 기관이 화면 낭독 지원을 제공할 때, 문항별 발음 지침을 별도 문서로 관리하고 시행 도구마다 따로 반영하는 경우가 있다. 발음 지시를 콘텐츠 안에 data-ssml로 넣어 두면 지침과 문항이 분리되지 않고, 도구를 바꾸어도 같은 지시가 따라간다.
수학과 과학처럼 수식과 기호가 많은 과목의 디지털 교과서를 제작하는 경우, 기호를 읽는 방식이 학년과 단원에 따라 달라진다. 저작 단계에서 발음을 지정해 두면 낭독 결과가 제작 의도와 어긋나는 일을 줄일 수 있다.
국내 에듀테크 기업이 QTI 3 기반 평가 도구를 해외에 공급하려는 경우, 접근성 요구사항이 조달 조건으로 제시되는 일이 많다. Data-SSML은 QTI 3의 부속 스펙이므로 QTI 3 구현과 함께 검토하는 것이 자연스럽다.
적합성 인증
Data-SSML 단독의 적합성 인증 프로그램은 1EdTech의 공개 자료에서 확인되지 않는다. 이 스펙은 QTI 3의 부속 기술 안내로 자리매김되어 있으며, 원문 게이트웨이가 인증 경로로 제시하는 것도 QTI 적합성 인증이다. 따라서 실무에서는 QTI 3 적합성 인증을 받는 과정에서 함께 다루게 된다. QTI 인증 절차와 체크리스트는 QTI Conformance Certification 페이지와 공개 저장소에 정리되어 있으며, 인증받은 제품은 TrustEd Apps Directory에 등재된다. 접근성 측면에서 QTI 3 형식은 Section 508과 WCAG 2.1 AA를 준수하도록 설계되어 있고, Data-SSML은 그 위에서 낭독 품질을 다루는 층을 맡는다.
관련 표준
- QTI: 문항과 시험의 표현 형식이다. Data-SSML은 QTI 3의 부속 스펙이며,
data-ssml속성의 정의가 QTI 3의 ASI 정보 모델에 포함되어 있다. - AccessForAll: 학습자의 접근성 요구와 자원의 접근성 특성을 기술한다. 학습자가 소리 내어 읽기를 필요로 한다는 사실은 AccessForAll이, 그 텍스트를 어떻게 읽을지는 Data-SSML이 담당한다.
- Common Cartridge: 학습 자원 묶음의 교환 형식이다. 패키지에 실리는 QTI 3 콘텐츠가
data-ssml지시를 그대로 담아 전달된다. - LTI: 플랫폼과 도구를 연결한다. 런치된 평가 도구가 표시하는 콘텐츠에 발음 지시가 함께 실린다.
- CAT: 적응형 평가의 상호운용을 다룬다. 적응형으로 제시되는 문항도 같은 QTI 문항 모델을 쓰므로 발음 지시가 그대로 적용된다.
원문 자료
- 게이트웨이: https://www.1edtech.org/standards/data-ssml
- Data-SSML 1.0 스펙: https://www.imsglobal.org/sites/default/files/spec/qti/v3/data-ssml_infobind/imsqtiv3p0_datassml_v1p0_InfoBind.html
- QTI 3 ASI 정보 모델: https://www.imsglobal.org/sites/default/files/spec/qti/v3/info/index.html
- QTI 스펙 문서 모음: https://www.imsglobal.org/question/index.html
- W3C Speech Synthesis Markup Language 1.1: https://www.w3.org/TR/speech-synthesis/
- QTI 적합성 인증 안내: https://www.imsglobal.org/1edtech-qti-conformance-certification
- TrustEd Apps 프로그램: https://www.1edtech.org/program/trustedapps
이 요약은 1EdTech의 공개 자료를 바탕으로 1EdTech Korea가 작성했습니다. 기술적 세부사항은 원문 스펙을 기준으로 합니다.
기술 개요
1EdTech Support for Speech Synthesis Markup Language (SSML) Using the 'data-ssml' Property Version 1.0 스펙은 SSML의 기능, 속성, 값을 보조 기술이 쉽게 소비할 수 있는 방식으로 JSON에 감싸는 data 속성(data-ssml)을 정의한다. 이는 QTI 3 표준과 관련된 부속 스펙 가운데 하나다.
'data-ssml' 속성은 QTI 3과 HTML의 텍스트 컨테이너 요소에 적용할 수 있으며, 콘텐츠 저작자가 텍스트 음성 합성기의 발음과 표시 방식을 제어해 학생이 인라인 텍스트 음성 변환 기술로 텍스트를 이해하도록 돕는다. 1EdTech 스펙은 이 개념에 관한 W3C의 스펙을 확장해 QTI 3의 Assessment Test, Section, and Item (ASI) 정보 모델 정의와 JSON을 포함한다.
1EdTech의 QTI 3 스펙은 문항(qti-assessment-item)과 시험(qti-assessment-test) 데이터, 그리고 그에 대응하는 결과 보고서를 표현하는 데이터 모델을 기술한다. QTI 3 스펙은 저작 도구, 문항 은행, 시험 구성 도구, 학습 시스템, 평가 전달 시스템 사이에서 문항, 시험, 결과 데이터를 교환할 수 있게 한다.
- 1EdTech QTI의 Assessment, Section, and Item(ASI) 정보 모델 3.0 스펙은 전체 QTI 3 스펙의 일부. ASI 문서에 SSML 기반 처리기(TTS)로 정보를 전달하는 데 쓰는 'data-ssml' 속성의 정의가 있음
- 'data-ssml' 속성과 발음 및 표시 안내는 QTI 3과 HTML 양쪽의 콘텐츠 텍스트에 적용 가능 — TTS에 의존하는 학생의 접근성과 학습 경험 개선
1EdTech Data-SSML 스펙은 다음과 같다.
- data-ssml 속성으로 전달되는 데이터의 형식 기술
- 허용되는 내용이 W3C Speech Synthesis Markup Language (SSML) Version 1 스펙에서 파생됨을 전제
- data-ssml 속성 안에 허용되는 정보의 정의
- data-ssml 속성의 정보에 대한 기술 바인딩으로 JSON을 상정
- JSON 형식의 정의와 기계 판독 가능한 JSON-Schema로의 표현
시작하기
아래 자료를 사용해 HTML의 음성 합성 지원(Data-SSML) 구현을 시작하십시오.
궁금한 점이 있으신가요?
1EdTech 전문가가 모든 단계에서 함께합니다.
기꺼이 도와드립니다. 1EdTech 회원은 support@1edtech.org로 문의할 수 있습니다.
회원 자료 (1EdTech Global 회원 로그인 필요)
- QTI Conformance Certification page — 인증 절차 안내
- QTI Certification
- QTI GitHub 저장소
- QTI Conformance 저장소 (인증 체크리스트 포함)
커뮤니티 소통
1EdTech에 참여하기
1EdTech의 평가 관련 활동에 참여할 수 있습니다. 기관과 에듀테크 공급사는 1EdTech Leadership 그룹에서 협력해 교육 기술 혁신을 진전시키고, 상호운용성을 촉진하며, 학습자의 성취와 성과를 지원합니다.
다른 1EdTech 회원과 교류하고 더 많은 자료를 찾으려면 1EdTech Community를 방문하십시오.
Product Steering Committee
1EdTech QTI 표준을 사용하는 평가 콘텐츠와 애플리케이션의 채택 확대에서 리더십을 보여 온 1EdTech Contributing 회원으로 구성되며, 인증을 촉진하고 시장 기반 정보를 제공합니다.
잠깐, 아직 1EdTech 회원이 아니신가요?
1EdTech에 가입하면 교육과 기술 분야의 가장 뛰어난 인재들과 협력하게 됩니다. Contributing, Affiliate, Alliance 중 어떤 회원이든, 1EdTech의 정신은 교육을 개선하겠다는 의지의 원동력이 됩니다.
이제 여러분의 목소리와 리더십을 더할 때입니다
언제든 도와드립니다
1EdTech Knowledge Base는 개방적이고 신뢰할 수 있으며 혁신적인 디지털 학습 생태계를 구축하는 데 도움이 되는 정보와 자료의 훌륭한 거점입니다.
궁금한 점이 있으신가요? 답을 준비해 두었습니다.
문의하기
