SafeW 加密语音与视频通话技术说明
声音和画面,同样值得被加密守护
文字消息可以加密,那实时语音和视频流呢?SafeW 的答案是:通话同样端到端加密。本章将介绍 SafeW 语音视频通话背后的技术实现与安全保障。
WebRTC:实时通信的基础
SafeW 的通话功能基于 WebRTC(Web Real-Time Communication)技术栈构建。WebRTC 是一套由 W3C 和 IETF 联合标准化的实时通信协议,Google、Mozilla、Apple 等主流厂商均已在其浏览器中内置支持。SafeW 在其桌面端和移动端也集成了相同的 WebRTC 引擎。
WebRTC 的核心优势包括:点对点直连(减少服务器中转延迟)、自适应码率、网络穿透能力(STUN/TURN/ICE)、以及可插拔的加密层。
媒体流加密:DTLS-SRTP
SafeW 使用 DTLS-SRTP(Datagram Transport Layer Security - Secure Real-time Transport Protocol)对语音和视频的媒体流进行加密。这是 WebRTC 标准强制要求的加密机制:
- 通话建立时,双方先通过 DTLS 握手交换 SRTP 加密所需的密钥材料。
- 握手完成后,所有音频和视频数据包使用 AES-128-CTR 或 AES-256-CTR 进行加密,并附带 HMAC-SHA1 完整性校验。
- 密钥在通话结束时即被丢弃,即使服务器记录下了加密的媒体流数据,事后也无法解密回放。
重要的一点是:DTLS-SRTP 是 WebRTC 标准的强制要求,这意味着在 SafeW 中,没有任何通话可以"绕过"加密——要么加密通话,要么无法建立连接。
通话质量与技术参数
- 视频分辨率:最高 1080p(Full HD),可根据网络状况自适应降至 720p 或 480p。
- 音频编码:Opus 编码器,支持 8-48 kHz 采样率,在 6 kbps 到 510 kbps 码率范围内灵活适配。
- 群组视频:最多支持 30 人同时开启摄像头,画面采用自适应网格布局。
- 延迟:同城用户通常 < 30ms,跨洲用户通常在 150-300ms 之间。
弱网优化
SafeW 的通话引擎针对弱网环境做了多项优化:
- 前向纠错(FEC):在数据包中附加冗余信息,当少量数据包丢失时可从冗余数据恢复,无需重传。
- 带宽估计(BWE):持续监测网络带宽变化,动态调整视频码率和分辨率,避免画面卡顿。
- 音频优先:当带宽极度受限时,系统优先保证音频质量,暂时降低视频帧率——因为听得清比看得清更重要。
提示:SafeW 通话信令(谁在呼叫谁、通话建立/挂断等控制消息)通过 SafeW 服务器中转,但信令内容本身也经过端到端加密,服务器仅能看到"A 和 B 正在建立通话",无法获知通话的具体内容。