Vigilant Ear

Vigilant Ear 👂🛡️

一款为听力障碍人士设计的声学雷达。

这是一款专为聋人、重听及 CODA 群体打造的应用程序。大多数声音识别应用只会告诉你声音是什么Vigilant Ear 还能告诉你声音在哪里、是谁发出的,以及他们在说什么 —— 将 iPhone 变成一个实时的声学三录仪,描述你周围的声音。

警笛声的方向和距离。你身后的敲门声。对话中的人们被描绘成独立的转录声音 —— 每个人都有字幕和方向定位。如果有人说的是你看不懂的语言,他们的话语可以翻译成你的语言。 提醒会发送到你的锁定屏幕、灵动岛和 Apple Watch,只需瞥一眼就足够了。

所有重要的事情都在设备上运行。音频不会为了识别而被记录或上传。任何事情都不依赖于听力。


它的服务对象

Vigilant Ear 是一种辅助功能辅助工具,而不是经过认证的生命安全设备。


它的功能

🧭 看到声音 —— 方向和距离

使用 iPhone 的立体声麦克风,Vigilant Ear 可以估算你周围声音的方位和大致距离,并将它们作为实时标记放置在朝上的雷达环和地图上。移动时,标记会保持在它们真实世界的位置。这是核心:对你听不到的世界的空间感知。

🚨 识别重要声音 —— 并警告你

设备端分类器可识别数百种日常声音,并监控关键类别 —— 警笛、警报 —— 包括专门的汽车警报类别 ——、门铃/敲门声、婴儿哭声、附近的人和恶劣天气。 当触发其中之一时,你会得到清晰的屏幕提醒、可选的推送通知以及独特的触觉反馈 —— 即使应用在后台运行或手机处于睡眠状态。关键类别默认准备就绪,因此启用通知并不意味着“所有声音都提醒”。关闭所有提醒类别,引擎在后台会完全休眠以节省电池。Sentinel 层会将提醒与独立证据 —— 方向、运动和公共数据源 —— 交叉核对,因此触发的提醒是经过佐证的,而不是单个分类器的孤立猜测。

恶劣天气警告来自官方的公共订阅源 —— 美国的 NWS、欧洲的 MeteoGate、中国的 CMA、韩国的 KMA、日本的 JMA、加拿大的 ECCC 和巴西的 INMET —— 所有用户均可免费使用。订阅源会缩小到覆盖你所在位置的范围。

⌚ Apple Watch + 实时活动 —— 一瞥即知

💬 说话人模式 —— 实时、定向字幕 (免费)

开启说话人模式 (Speaker Mode),Vigilant Ear 会将在你附近说话的人转录为字幕块,每个声音一个。 设备端的说话人日志记录 (diarization) 保持声音的区别 —— 在说 什么 —— 并在内环上带有方向提示。实时说话人会高亮显示;随着空间需要,较旧的文本会滚动移出。字幕是免费的;自动翻译是可选的 Power Pack+ 层。字幕还可以通过蓝牙听力设备朗读出来 —— 免费,在偏好设置中开启。

🌐 说话人自动翻译 —— 你的语言,实时 (Power Pack+)

在开启说话人模式的情况下,当附近的人说另一种语言时,Vigilant Ear 可以检测到它,并以你的语言呈现他们的字幕,并在他们的字幕块上显示源语言。从听到 → 分离说话人 → 转录 → 翻译 → 显示的链条,完全在设备端运行;唯一需要网络的时刻是从 Apple 进行一次性语言包下载。你不需要事先知道或选择另一种语言。

这是迄今最接近科幻中万能翻译器的产品——一台"直接听懂"的设备。Vigilant Ear 自行检测语言,跟踪房间里的每一位说话者,把所有人的话都以您的语言实时字幕呈现——无需耳机,无需设置,全程在设备上运行。

graph LR
    A["只管听"] --> B["自动检测语言"] --> C["分离每个人的声音"] --> D["整个房间实时字幕成您的语言"]

🎵 音乐和广播感知 (Power Pack+)

ShazamKit 可识别你周围播放的音乐并跟踪歌曲变化。

🎛️ 声学示波器 —— 像工程师一样看声音 (Power Pack+)

以专业级视图实时呈现周围的声音:频谱、语谱图、1/3 倍频程 RTA 频段、色度与谐波分音——还有用于采集声音、训练自定义声音包的工具。

📦 自定义声音包 —— 教它认识你的世界 (Power Pack+)

教 Vigilant Ear 识别对您重要的声音——从本地鸟鸣到楼门门铃。扩展包叠加在内置检测之上,绝不会挤占警笛和警报。应用内附分步指南。

🛰️ Constellation —— 多部 iPhone,共享同一只耳朵 (Power Pack+)

使用两部或多部支持超宽带 (Ultra-Wideband) 的 iPhone(自 iPhone 11 以来的大多数机型),Constellation 会将它们配对,以便它们可以感知彼此的位置,并将每部手机听到的声音融合为更精确的声音来源图片 —— 一个分布式的无源监听阵列。该功能仅限于拥有合适硬件的设备。早于对等设备连接时间的网格 (Mesh) 字幕不会被重传。

伙伴消息 —— 向已链接伙伴的手机发送一条简短文字;它会出现在对方的字幕信息流中,并可在设备端翻译成对方的语言后送达。消息功能顾及年龄:基于 Apple 的声明年龄范围(Declared Age Range),成年人与未成年人之间的消息保持关闭,除非双方都主动为对方命名。提醒和字幕从不受限 —— 仅限人与人之间的文字消息。

📷 摄像头 AR —— “看到声音”

在标题栏上打开摄像头胶囊,在实时摄像头视图中将检测到的声音固定在它们真实的方位。标记按说话人或声音类别和方向聚集,以便视图保持可读性;声源变安静时会逐渐淡出。

🗺️ 地图、道路和路径预测

声音方位会投影到地图上的真实 GPS 坐标上。车辆的声音可以吸附到附近的街道上并预测其路径,因此一辆路过的卡车看起来像是在沿着道路移动,而不是穿过建筑物。(尝试一下消防车演示。)

🪄 功能游乐场 —— 即使没有耳朵也能证明

功能游乐场对所有人公开:居家和街头练习(敲门、警报、婴儿、警笛、天气)、多部手机和对话演示,以及清晰的水印,以便练习永远不会伪装成真实事件。关闭面板会干净地清除演示(没有卡住的 GPS 欺骗,没有残留的标志)。

♿ 辅助功能优先

专为聋人/重听/CODA 和色盲用户打造:颜色独立的提示,≥44 pt 的点击目标,尊重减弱动态效果 (Reduce Motion),多模式提醒(触觉 + 视觉 + Watch),以及一个启动验证屏幕,用清晰的绿色 / 灰色 / 红色(以及暗橙色的“不允许”)状态显示权限状态 —— 包括充当主提醒开关的通知授权。


免费和 Power Pack+

安全核心是永远免费的:

Power Pack+ 是一次性解锁(不是订阅),有 90 天的免费试用期。它增加了超能力:

无论是免费还是 Power Pack+,您的音频都会留在设备上进行识别 —— 该层级只会改变哪些功能被解锁,绝不会改变原始音频被发送到哪里进行分析。


它是如何工作的(幕后)

Vigilant Ear 是一个本地优先、设备端的管道。原始音频在一个高优先级分接点上被捕获,复制到一个池化缓冲区空闲列表中(在实时路径上没有分配抖动),并散开到独立的处理器中,而不会停止 UI 或中断流:

graph TD
    A["立体声麦克风分接"] --> B["池化缓冲区快照"]
    B --> C["声音分类器 (Apple Neural Engine)"]
    B --> D["TDOA / 波束赋形 → 方位和距离"]
    B --> E["说话人日志记录 (WeSpeaker, ANE) → 谁"]
    E --> F["语音识别 (SpeechAnalyzer) → 词语"]
    F --> G["设备端翻译 → 您的语言"]
    C & D & F & G --> H["雷达 · 字幕 · 地图 · 提醒 · Watch · 实时活动 · AR"]

隐私

完整详情:PRIVACY.md · TERMS.md · SUPPORT.md


硬件和平台

当前 App Store 版本: 1.1.0。为现代 iOS(SpeechAnalyzer 时代)构建。


本地化

完全本地化 —— 界面、提醒和字幕 —— 支持英语、西班牙语、葡萄牙语(巴西)、法语、德语、阿拉伯语、日语、简体中文、韩语、俄语和意大利语(11 种语言)。遵循系统区域设置或在应用程序中手动选择。


状态和免责声明

Vigilant Ear 是一种实验性的声学辅助工具,而不是经过认证的生命安全实用程序。定位分辨率因周围环境、天气、风力和麦克风硬件而异。请始终保持正常的周围环境意识 —— 不要依赖它作为你安全的唯一信息来源。

某些功能(摄像头 AR 标记、在 Apple 授予时升级紧急警报权利、高级多包声音创作)在不断发展;免费的居家/街头看护和实时字幕是您从第一天起就可以信任的产品。


联系方式: vigilantear@wingdingssocial.com

为聋人/重听群体和声学研究倾心打造 ❤️。

Wingdings, Inc.

© 2026 Wingdings, Inc.
All rights reserved.
Patent Pending