首页 > 技术支持 > 技术文章 > 应用方案

【애플리케이션 솔루션】 AI 스마트 글래스의 진화! Awinic Dijiang™ 오디오 업링크 알고리즘으로 안경을 '도구'에서 'AI 플랫폼'으로

2026-04-13

대형 모델의 성숙도가 높아지고 Multi-Modal 상호 작용 기술이 발전함에 따라 AI 안경은 더 이상 AR/VR의 경량 하위 필드가 아닙니다. 그것은 적의 매개체로 재정의되는 차세대 인간-컴퓨터 상호작용의 핵심입니다.실시간 번역, 첫 번째 보기 녹화, AR 내비게이션, 장벽 없는 지원과 같은 필요한 장면에 대한 사용자의 기대가 계속 가열됩니다. 야외에서 vlog를 녹화 할 수 있습니까? 바람이 부는 환경? 시끄러운 환경에서 전화 할 수 있습니까?지하철이 울리는 동안 주문에 대한 명확한 메시지가 들리십니까? Aiwei는 사용자 문제를 자세히 조사하고 업계 최고의 AI 안경 제품에 대한 강력한 지원을 제공합니다.

저는 그렇습니다. 사랑은 디잔 강입니다.™알고리즘 응용 시스템

사랑은 장의 황제이다.™전자 장치 용 Ai 시작한 업링크 음성 알고리즘 세트입니다. 윈드 노이즈 알고리즘, 라운드 사운드, 노이즈 감소, 에코 제거, 음성 녹음, 빔 포밍과 같은 핵심 알고리즘을 다루는 것은 비디오 레코딩 및 통화와 같은 장면을위한 여러 솔루션을 만듭니다.다양한 주류 플랫폼으로의 통합을 지원하고 다양한 장면 요구에 맞는 유연성 알고리즘 모듈을 수용할 수 있습니다. 비즈니스 미팅, 야외 여행, 일상 메모 작성 등 다양한 사용 사례를 위한 포괄적인 AI 기반 스마트 안경

그림 1 인공지능 안경의 애플리케이션 블록 다이어그램

👓AI 안경의 일반적인 아키텍처에서 멀티 마이크 어레이에 의해 수집 된 음향 신호는 고정밀 ADC에 의해 샘플링되어 실시간 처리 장치 (Djiang's AI) 지연이 적은 버스가 전달됩니다.™DSP 또는 NPU에 배포할 수 있으며 2-8 개의 멀티 마이크 배열을 지원합니다.

둘. Ai는 다이아낭 강입니다™AI 안경에 대한 업 링크 알고리즘 응용 시나리오의 예:

1.🌬블로그 시나리오를 향상시켜 야외에서 촬영하는 동안 바람 소음을 쉽게 처리하고 항상 보컬을 지우십시오.

그런 후회를 남긴 적이 있습니까?

🚴🏻‍♀타는 동안, 울부짖는 바람이 내 내면의 독백을 익사시킵니다.
🏃🏻‍♀그림자 촬영을 실행하는 동안 호흡과 인간의 목소리가 구별 할 수없는 안개로 혼합됩니다.
🚶🏻‍♀야외 산책 중에는 주변 분위기가 풍부하고 생생하며 명확한 "말하고 싶다" 가 모두 누락 된 것 같습니다.

그림 2 모션 윈드 노이즈 장면 시위


🌀이런 이유로 사랑은 디잔의 황제로 봉사했습니다.™AI 안경을위한 새로 개발 된 사내 소음 알고리즘:

마이크 배열로 캡처된 오디오 신호는 바람 소음을 정확하게 만들기 위해 바람 소음 제거 알고리즘에 의해 처리됩니다. 이를 통해 식별 및 억제가 음성 정의를 향상시킬 수 있습니다. 결과적으로 라운드 사운드 모듈은 몰입감을 향상시키고 vlogs의 음향 미학을 재정의합니다.

이 기능을 사용하면 강한 바람을 두려워 할 필요가 없으며 모든 프레임이 깨끗하고 따뜻함으로 가득 찬 사운드와 일치합니다.

그림 3 비디오 블로깅 (Vlog) 장면의 알고리즘 블록 다이어그램

효과 표시

바람 소음 알고리즘은 다른 환경에서 고유합니다.

✅바람과 빛의 산들 바람이 없습니다. | 일상적인 대화에서 공간적 깊이를 지닌 최고의 사운드 필드의 몰입적이고 지능적인 구성은 영화 같은 느낌을 줄 것입니다.
✅Gair | 주변 사운드 유지 및 오디오 신호 향상 SNR
그것은 "침묵" 에 관한 것이 아닙니다. 그것은 사람들을 번잡함에서 벗어나게 하고, 분위기를 축적하고 그것을 질감시키는 것입니다.

2.🌐모든 시나리오에는 개선, 지능형 노이즈 제거 및 정확한 음성 전송이 필요합니다.

이런 순간을 경험해 본 적이 있습니까?

💻화상 회의에서 내 목소리가 젖빛 유리로 덮여있는 것처럼 들렸다. 한 동료가 찡그리며 물었다. "방금 뭐라고 했어?"
🕶거리의 중요한 전화, 교통의 포효 및 배경 "whirr-" 의 지속적인 경보에 응답 할 때 다른 모든 끝은 안정적입니다.
📝해외에서 교환하는 동안 환경은 상당히 시끄 럽습니다. 점원이 스핀 다발을 집어 들고 말합니다. "스핀 좋아하세요?" (당신은 핀치를 좋아합니까?), 번역 도구는 "당신은 스페인 사람처럼 보입니다." ..

그림 4 번역 시나리오 데모


📞이런 이유로 사랑은 그를 디잔의 황제라고 생각했습니다.™종단 간 통화를위한 자세한 음향 시스템:

마이크 어레이에 의해 포착 된 음향 신호는 에코 캔슬 모듈에 의해 에코 신호와 정확하게 분리되며, 빔 형성은 사운드의 보이지 않는 스포트라이트를 효과적으로 "켭니다". 음원 방향으로 고정되어 유효 픽업 영역을 좁 힙니다.마지막으로 노이즈 감소는 오디오 신호에 대한 왜곡을 최소화하면서 주변 노이즈를 억제하는 데 유용합니다. 통화 품질 경험.

그림 5 통화 시나리오의 알고리즘 블록 다이어그램


3.🗣웨이크 업 인식의 '첫 번째 신경 허브'

이런 순간을 경험해 본 적이 있나요?

🚇안경을 지하철에 놓고 날씨에 대해 물으려고하지만 바람이 당신의 목소리를 익사시킵니다.

☕카페에서 친구들과 수다 떨면서 "야-" 라고 말했는데, 우연히 인공지능 안경에 깨우기 명령이 발동되었다.

🕺🏻내가 전화를 걸었을 때 부담감을 느끼지 않고 걷는 동안 시스템은 2 초 동안 침묵을 지키고 마침내 응답했습니다. 모두...

그림 6 음성 각성 시나리오 데모


🎤따라서 아이는 Jiane이되었습니다.™곧 출시됩니다. AI 안경을 위해 특별히 설계된 프런트 엔드 음성 게이트 키퍼:

음성 대 잡음 비율 (바람 소음, 사람의 말, 에코) 의 복잡한 환경을 개선 할 수 있으며 실제 착용 시나리오에서는 인식의 안정성이 크게 향상됩니다. 단어 오류율이 6% 이상 떨어졌습니다.

7 개의 웨이크 업 인식 장면 알고리즘의 블록 다이어그램


⏳요즘, 누군가를 깨우는 것은 단순히 깨우는 것만큼 쉽지 않습니다. 깨어나지 않으면 불안하고 어색하게 깨어납니다. 느린 반응이 추가되어 고갈됩니다. 사용자 경험은 궁극적 인 판단입니다.앞으로 Aiwei는 전력 소비가 매우 낮고 깨우기 속도가 매우 높은 음성 활성화 알고리즘을 개발했습니다. 편리하고 반응이 좋습니다. 결국, 최고의 상호 작용은 당신이 깨닫지 못하는 것입니다.