档案库 · 产品创意 · 产品决策 · 2023
苹果个人声音:iOS 17让用户在失去语言能力前留存自己的声音
大声朗读约150个短语,iOS 17即可在设备端创建一个私密的声音克隆,让你输入的文字以你自己的声音说出。
苹果公司
当时的题目
People with ALS, muscular dystrophy and similar conditions can progressively lose their ability to speak, leaving only generic-sounding text-to-speech voices. Apple, which builds accessibility features with disability communities, set out to let a person keep their actual voice for the day they can no longer speak.
它是怎么成立的
每年,被诊断患有渐冻症或类似FSHD疾病的人都面临失去说话能力的风险。标准的文本转语音工具可以为他们说话,但声音像是陌生人的;苹果的无障碍团队希望保留声音本身。2023年5月宣布的个人声音功能,让用户在自己仍能说话时录制自己的声音,以便设备日后可以代替他们说话。
设置过程非常简洁:在iPhone或iPad上大声朗读一组随机文本提示——苹果称约15分钟音频,早期测试报告称150个短语需20-30分钟。设备端机器学习在本地构建并存储合成声音,保持数据私密,而个人声音可连接实时语音,使用户在与他人通话、FaceTime和面对面交谈时,能够输入想说的话,以自己的声音说出来。
苹果将这一功能定位为面向有语言丧失风险的人群,而非好奇的消费者。2023年11月,它发布了由塔伊加·维迪提执导、特里斯特拉姆·英厄姆博士主演的短片《失去的声音》。英厄姆是新西兰医生和残障倡导者,他患有FSHD——一种最终可能导致语言丧失的疾病——并在现实生活中使用个人声音;该片在12月3日国际残疾人日之前上映。
妙在哪
- 它将人的声音视为一种资产,可以在失去之前存入银行,而不是事后补偿损失。
- 录音在声音健康时进行,并遵循指南脚本,因此模型在需要时已准备好——而非从稀少的旧录音中重建。
- 设备端机器学习保持声音私密,消除了基于云的克隆可能给最需要的人带来的信任障碍。
- 将克隆与实时语音绑定,使其有了日常应用——在通话和FaceTime中输入的文字被大声朗读——而不是假设的未来用途。
做出来什么
Personal Voice turned 'voice banking' from a niche assisted-communication service into a free operating-system feature, with the voice model kept private on the device. In November 2023 Apple released 'The Lost Voice', a Taika Waititi-directed short starring Dr. Tristram Ingham, a New Zealand physician with FSHD who uses Personal Voice in real life, timed to the International Day of Persons with Disabilities.
可以借走的
不要用通用的声音去弥补个人损失:让用户自己的声音成为最终交付物,为建立信任将模型保存在设备端,并在需要之前发布。
后来
个人声音随2023年9月的iOS 17公开版发布,最初支持英语,苹果支持在iPhone、iPad和Apple silicon Mac上创建。《失去的声音》于2023年11月底首映,并在国际残疾人日之前引发了对语音无障碍的报道;CNET的记者测试了该功能,称其相似性不可思议且令人印象深刻。苹果将个人声音作为与残障社区共同设计的几个功能之一,此外还有实时语音、辅助访问和指向与说话。
资料来源
- iOS 17 Lets You Create a Voice That Sounds Like You
- iOS 17 Lets You Clone Your Voice on Your iPhone
- Taika Waititi's New Apple Film Shows Off the iPhone's Speech Accessibility Tools
发现哪里写错了?告诉我们。
轮到你了
你刚读完一个点子。把你手上的题目说出来,看看谁接过同样的题。
免费账号 · 3 次免费提问 · 不用绑卡