1. 기존 등록기술 검토 결과
출원번호 10-2026-0048541 · 청구항 13개 · 결정일 2026.04.21.
발명의 명칭 외부 환경음 증폭 및 통신 음향을 통합 제공하는 두부 보호구용 음향 시스템
독립항 1의 핵심은 ① 외부 음향 수집부, ② 환경음 처리부, ③ 통신 음향 입력부, ④ 보호구 상태 인식부, ⑤ 음향 제어부, ⑥ 출력부이며, 보호구 종류 또는 착용 상태에 따라 처리 파라미터를 다르게 설정하는 구성이다.
2. 신규 발명의 명칭(안)
전단 및 후단 생성형 인공지능과 적응형 음향 처리 코어를 결합한 맥락인지형 음성 서비스 제공 방법, 시스템 및 컴퓨터 판독가능 기록매체
P25-0418은 신규 발명 그 자체가 아니라 중간 실행 코어의 실시예로 활용한다. 신규성의 중심은 전단 생성형 AI → 음향처리 코어 → 후단 생성형 AI의 양단 결합과 폐루프 제어이다.
3. 발명의 핵심 개념
앞단 생성형 AI는 자연어 지시, 센서 및 음향 특징을 해석하여 맥락과 처리정책을 생성한다. P25-0418 기반 중간 코어는 외부 환경음과 통신 음향의 제거·강조·선택·혼합·출력을 실제 수행한다. 뒤단 생성형 AI는 증폭된 음향과 처리 메타데이터로 상황 설명, 대화, 요약, 경보, 기록, 서비스 화면 또는 업무흐름을 생성한다. 뒤단 결과는 다시 앞단의 정책 갱신에 사용된다.
4. 핵심 구성
- 다중 맥락 입력부: 음향 특징, 사용자/보호구 상태, 기기 상태, 텍스트 또는 음성 과업 지시
- 전단 생성형 AI부: 환경·대상음·목적·위험도를 추론하고 처리 정책 스키마를 생성
- 가드레일 검증부: 청력 안전, 지연시간, 이득, 중요 경보 보존 조건 검사 및 보정
- 적응형 음향 처리 코어: P25-0418의 수집·처리·통신입력·상태인식·음향제어·출력 구성을 활용해 정책 실행
- 후단 생성형 AI부: 처리 음향과 맥락·정책 메타데이터로 목적별 서비스 결과 또는 실행 워크플로 생성
- 실행 및 피드백부: 경보·대화·요약·기록·UI·API 호출을 실행하고 평가정보를 전단에 환류
5. 독립청구항 초안
컴퓨팅 장치에 의해 수행되는 생성형 인공지능 기반 음성 서비스 제공 방법에 있어서, 음향 입력 신호 및 맥락 정보를 획득하는 단계; 제1 생성형 인공지능 모델을 이용하여 상기 음향 입력 신호 및 상기 맥락 정보로부터 맥락 상태와 음향 처리 정책을 생성하는 단계; 상기 음향 처리 정책을 안전 제약조건에 따라 검증 또는 보정하는 단계; 검증 또는 보정된 상기 음향 처리 정책에 따라 외부 환경음과 통신 음향 중 적어도 하나에 대해 제거, 강조, 선택, 혼합 또는 출력 경로 제어를 수행하여 처리 음향 신호를 생성하는 단계; 제2 생성형 인공지능 모델에 상기 처리 음향 신호와 상기 맥락 상태 또는 상기 음향 처리 정책에 관한 메타데이터를 입력하여 목적별 서비스 결과 또는 서비스 실행 워크플로를 생성하는 단계; 상기 서비스 결과 또는 상기 서비스 실행 워크플로를 출력 또는 실행하는 단계; 및 상기 서비스 결과의 평가정보에 기초하여 상기 음향 처리 정책을 갱신하는 단계를 포함하는, 생성형 인공지능 기반 음성 서비스 제공 방법.
전단 생성형 인공지능부, 가드레일 검증부, 적응형 음향 처리 코어, 후단 생성형 인공지능부 및 서비스 실행·피드백부를 포함하고, 전단 생성형 인공지능부가 생성한 정책으로 중간 코어를 제어하며 후단 생성형 인공지능부의 서비스 평가정보로 상기 정책을 갱신하는 시스템.
프로세서에 의해 실행될 때 상기 방법을 수행하게 하는 명령어가 저장된 비일시적 컴퓨터 판독가능 기록매체.
6. 종속청구항 후보
- 맥락 상태가 소음 유형, 화자 거리, 위험도, 착용/밀폐 상태 및 사용자 청취 프로필 중 둘 이상을 포함.
- 처리 모듈이 빔포밍, 음원 분리, 잡음 억제, 주파수별 이득, 동적 범위 압축, 위험음 강조를 포함.
- 정책이 JSON 등 기계판독 가능 스키마로 생성되고 허용 범위 밖 값이 보정됨.
- 위험음 신뢰도가 임계값 이상이면 통신 음향보다 환경음을 우선 출력.
- 두부 보호구의 종류 또는 착용 상태에 따라 후보 정책 집합을 제한.
- 후속 서비스가 음성인식, 화자분리, 요약, 위험 이벤트 감지, 돌봄 기록 중 하나 이상.
- 서비스 평가 정보가 WER, 이벤트 검출 신뢰도, 지연시간 또는 사용자 피드백을 포함.
- 온디바이스와 서버 간 연산 배치를 지연·전력·개인정보 조건에 따라 결정.
- 원음 또는 민감 음향을 저장하지 않고 특징정보 또는 비식별 메타데이터만 이용.
- 정책 생성 이유·입력 근거·보정 이력을 감사 로그에 저장.
7. 도면 구성(안)
- 전체 시스템 블록도
- 다중 맥락 추론 및 구조화 상태 생성도
- 처리 정책 스키마와 가드레일 검증 흐름도
- 적응형 음향 처리 체인 구성도
- 후속 AI 서비스 연계 및 폐루프 피드백도
- 두부 보호구 적용 실시예
- 의료·돌봄 적용 실시예
- 전체 동작 순서도
8. 프로토타입과 실시가능성 자료
포털의 작동 프로토타입은 브라우저 마이크 입력을 받아 환경·목적별 정책에 따라 high-pass, low-pass, dynamic compressor, 개인 이득을 실시간 적용한다. 정책 출력과 변경 이력을 화면에 기록하므로 “입력 → 맥락 → 정책 → 검증 → 실행 → 로그”의 실시 흐름을 시연할 수 있다.
9. 출원 전 보강자료 체크리스트
- 기존 등록특허와 신규 발명의 발명자·권리자 관계 확인
- 생성형 AI 정책 스키마 예시 3종 이상
- 환경별 처리 전후 음원과 STOI/WER/지연시간 비교
- 가드레일 허용 범위 및 실패 시 fallback 정책
- 모델·DSP 모듈 연결 인터페이스와 의사코드
- 선행기술조사 및 청구항 차별성 검토
- 공개 전 국내 우선출원 여부 결정
본 문서는 연구·출원 준비용 기술 초안이며, 법률 의견이 아니다. 실제 출원문서는 변리사와 최종 검토해야 한다.