audio-processing

2 개의 포스트

discord3분 읽기큐레이션 요약

디스코드의 강력한 크

Discord Social SDK의 커뮤니케이션 기능이 클로즈드 베타를 종료하고 게임에 정식 통합될 단계로 전환됐다. 개발자는 계정 연동, 친구 목록 통합, 크로스플랫폼 텍스트·음성 채팅, Rich Presence, 게임 초대 등을 통해 플레이어 간 연결과 재방문율을 높일 수 있다. SDK에는 채팅 기록, 커스텀 음향 처리, 오디오 진단 기능도 추가됐으며, 출시 승인을 위해 핵심 기능 통합과 안정적인 사용자 경험을 충족해야 한다. ## 게임 내 소셜 기능을 강화하는 Discord Social SDK - Discord 기능을 게임에 직접 통합해 플레이어가 Discord 계정이 없어도 친구와 연결할 수 있다. - Discord 계정을 연동한 플레이어는 게임과 Discord 양쪽에서 친구 목록을 통합해 사용할 수 있다. - 계정 연동 이용자는 더 자주 게임에 돌아오고 세션 및 플레이 일수가 늘어나는 효과가 확인됐다. - 친구 찾기와 파티 구성을 간소화해 멀티플레이어 진입 장벽을 낮춘다. ## Rich Presence와 게임 초대 - **Rich Presence**는 데스크톱, 콘솔, 모바일에서 플레이어의 게임 활동을 Discord에 표시한다. - 플레이어 프로필에서 한 번의 클릭으로 게임에 참여할 수 있는 기능을 구성할 수 있다. - 게임 활동 노출은 신규 플레이어 유입과 기존 플레이어의 재참여를 돕는다. - **Game Invites**를 사용하면 Discord 또는 게임 내부에서 초대를 보내고, 특정 파티나 로비로 바로 입장할 수 있다. ## 크로스플랫폼 텍스트·음성 채팅 - 데스크톱, 모바일, 콘솔 간에 플랫폼 구분 없이 채팅할 수 있다. - 게임 내 다이렉트 메시지를 Discord 계정 연동 사용자에게 Discord에서도 표시할 수 있다. - Discord의 음성 기술을 게임의 길드, 매치, 로비에 적용해 실시간 음성 대화를 제공한다. - **Linked Channels**를 이용하면 게임 내 텍스트 로비를 사용자가 선택한 Discord 채널과 연결할 수 있다. - 이를 통해 길드, 그룹, 스쿼드가 게임 안팎에서 동일한 대화 공간을 사용할 수 있다. ## 새롭게 추가된 기능과 오디오 개선 - 활성 로비에 **채팅 기록**이 제공되어 플레이어가 게임 세션 사이에도 이전 대화를 확인할 수 있다. - 다이렉트 메시지의 채팅 기록도 추후 지원될 예정이다. - **커스텀 효과 처리**를 통해 FMOD, Wwise 같은 오디오 미들웨어로 Discord 음성에 게임 특화 효과를 적용할 수 있다. - 에코 제거와 소음 감소 문제를 분석할 수 있도록 오디오 진단 정보를 제공한다. - 모바일 음성 기능의 오디오 품질과 연결 안정성도 개선됐다. ## 개발 및 운영 시 고려할 사항 - 음성 채팅 관리, 사용자 조정·제재, 로비 채팅 기록 관리와 설계에 관한 별도 문서가 제공된다. - SDK 패키지에 채팅 기능이 포함되지만 사용량에는 레이트 리밋이 적용된다. - 개발 초기에는 제한된 사용량 내에서 게임에 채팅 기능을 구현하고 테스트할 수 있다. - 실제 서비스 전에는 Discord 개발자 포털에서 플랫폼과 애플리케이션을 설정해야 한다. ## SDK 접근 및 출시 승인 요건 - Discord Developer Portal에서 SDK를 시작하고 대상 플랫폼을 선택한다. - 새 Discord Application을 만든 뒤 **Enable Discord Social SDK**를 활성화한다. - 게임 승인 전 다음 조건을 충족해야 한다. - Discord 계정 연동, Rich Presence와 Discord Joins, Discord 친구 기능 등 핵심 기능 통합 - 게임과 Discord 클라이언트 양쪽에서 모든 사용자 흐름이 정상 작동 - 사용자 거부, 실패 상태 등 예외 상황 처리 - 사용자가 계정 연동 기능을 쉽게 찾고 이해할 수 있는 UI 제공 - 통합 화면 캡처와 개발 일정 등 심사 자료 제출 - 연령 제한 사용자 보호 요건 준수 실제로 도입할 때는 먼저 계정 연동, 친구 목록, Rich Presence와 초대 기능을 안정적으로 구현한 뒤 텍스트·음성 채팅과 채널 연결을 확장하는 것이 좋다. 특히 레이트 리밋, 모더레이션, 음성 장애 진단, 플랫폼별 실패 처리를 출시 전에 충분히 검증해야 한다.

원문 읽기(새 탭에서 열림)
datadog원문

서버 의존성 없이 실시간 클라이언트 사이드 노이즈 억제 라이브러리를 구축한 방법 (새 탭에서 열림)

Datadog의 CoScreen 팀은 원격 협업 중 발생하는 배경 소음을 실시간으로 제거하기 위해, 높은 성능과 이식성을 갖춘 오픈소스 라이브러리인 `dtln-rs`를 개발했습니다. 기존의 노이즈 억제 도구들은 WebRTC와의 통합이 어렵거나 고성능 서버 자원을 요구한다는 한계가 있었으나, 이 라이브러리는 클라이언트 측에서 효율적으로 동작하도록 설계되었습니다. 결과적으로 M1 맥북 프로 기준 1초의 오디오를 단 33ms 만에 처리하며, 서버 의존성 없이 다양한 플랫폼에서 고품질의 실시간 소음 제거를 가능하게 합니다. **dtln-rs: 경량화된 실시간 노이즈 억제 라이브러리** * DTLN(Dual-Signal Transformation LSTM Network) 모델을 기반으로 구축된 Rust 언어 기반의 프로젝트입니다. * WebAssembly(WASM), Native Rust, Node.js 네이티브 모듈 등 다양한 타겟으로 빌드할 수 있어 웹 브라우저와 네이티브 앱 모두에 쉽게 통합 가능합니다. * 실제 테스트에서 이웃의 잔디 깎는 기계 소음을 완전히 제거할 정도로 뛰어난 성능을 보여주었으며, 이를 통해 사용자에게 실제적인 가치를 전달합니다. **DTLN 모델의 작동 원리와 효율성** * STFT(단시간 푸리에 변환)를 사용하여 소리를 작은 단위로 분해하고, 주파수별 볼륨(크기 스펙트럼)과 위상(Phase) 정보를 분석합니다. * LSTM(장단기 메모리) 신경망이 포함된 모델을 통해 분석된 데이터 중 어떤 부분이 음성이고 어떤 부분이 소음인지 실시간으로 판단합니다. * 위상 정보와 크기 성분을 모두 활용하는 딥러닝 방식 덕분에 에어컨 소음, 카페 소음, 종이 부스럭거리는 소리 등 다양한 환경에 동적으로 적응하며 즉각적인 감쇠가 가능합니다. **기존 기술의 한계와 개발 배경** * 기존의 고성능 AI 노이즈 제거 모델들은 대부분 강력한 서버 하드웨어를 필요로 하며, 이는 추가적인 지연 시간(Latency)과 막대한 서버 비용을 발생시킵니다. * WebRTC는 널리 쓰이는 오픈소스 기술임에도 불구하고 내장된 노이즈 제거 기능은 구세대 솔루션에 머물러 있어 현대적인 협업 도구들의 품질 요구 수준을 충족하지 못했습니다. * Google 등 대기업이 사용하는 최첨단 모델은 비공개 소스이거나 전용 서버 인프라에 종속되어 있어, 소규모 팀이나 일반 개발자들이 자신들의 앱에 고품질 기능을 구현하기에는 제약이 컸습니다. 실시간 오디오 및 비디오 애플리케이션을 개발하면서 서버 비용 부담 없이 고성능 노이즈 캔슬링 기능을 추가하고 싶다면 `dtln-rs`를 검토해 보시기 바랍니다. 클라이언트 측 리소스를 효율적으로 활용하면서도 WebRTC와 매끄럽게 결합되는 이 라이브러리는 사용자 경험을 한 단계 끌어올리는 실용적인 해결책이 될 것입니다.