news 2026/9/22 0:24:19

人工智能应用-机器听觉: 09.什么是声纹?

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
人工智能应用-机器听觉: 09.什么是声纹?

研究者很早就希望通过机器也能“听声辨人”。1962 年,贝尔实验室的 Lawrence Kersta 在《自然》杂志中首次提出“声纹”(Voiceprint)这一概念,认为声音就像指纹一样具有可用于身份识别的独特性。

Kersta 在 1962 年提出“声纹”概念的论文

“声纹”一词形象地表达了发音人的声音特异性:世界上没有两个人的声音是完全相同的,即使是双胞胎也无法做到。这是因为声纹背后具有生理基础(声带、声道形状等)与行为特征(说话习惯、语调等)的综合影响。

事实上,即使同一个人在不同时间的声纹也会有差别;比如早晨与傍晚、疲劳与清醒的情况下,说话声音会有不同。这一点与指纹不同,因为指纹从出生后就不会发生显著变化,而声纹容易受生理与心理状态的影响。到目前为止,人们还没有发现声音中和人一一对应的、一生保持不变的“声纹”。

声纹识别(或“说话人识别”)是让机器通过声纹判断人身份的“听觉版”生物特征识别技术,与其他生物认证手段相比,具有以下优势:

非接触性:与指纹、掌纹相比,声纹采集不需要身体接触;

较低隐私泄露风险:相比于人脸,声音被非法获取后复刻还具有一定技术难度;

设备简单,使用方便:与虹膜等方式相比,声纹无需昂贵的专用采集装置;

意图真实性:声纹需要人主动发声才可采集,可以在一定程度上可确保认证意图的真实性,从而防止被盗用。

此外,在一些特殊应用场景中,人用声音表达的内容还可以兼具“签字”或“意图确认”的作用,从而提高交互的安全性与准确性。例如,在合同签订时,人用声音所表述的内容,可以认为代表了他的真实意图,对于合同的真实性有了更合理的保证。

声纹识别与其他生物特征识别

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/22 4:02:58

【C/C++】MPSC无锁队列

MPSC Queue:多生产者单消费者无锁队列 SPSC无锁队列,参考https://blog.csdn.net/qq_46105170/article/details/157458924。 概述 MPSC(Multi-Producer Single-Consumer)队列是一种允许多个生产者线程同时写入、但只有一个消费者…

作者头像 李华
网站建设 2026/9/20 10:18:49

本地部署FastGPT使用在线大语言模型

FastGPT 是一个基于 LLM 大语言模型的知识库问答系统,提供开箱即用的数据处理、模型调用等能力,它背后依赖OneApi开源项目来访问各种大语言模型提供的能力。各大语言模型提供的访问接口规范不尽相同,为此OneApi项目提供了统一的API接口去对接…

作者头像 李华
网站建设 2026/9/20 18:35:48

为pngme拓展对gif格式支持

为pngme拓展对gif格式支持引言GIF格式简读GIF结构原始数据到结构数据读屏幕逻辑数据读图像数据读取扩展块读取子块链将文本写入应用扩展块结构数据到原始数据引言 前序文章为pngme拓展加密功能与jpg格式支持-CSDN博客,其中所提到的东西,本文不会重复提及…

作者头像 李华
网站建设 2026/9/20 17:34:21

互联网大厂Java求职面试实战:微服务、缓存与AI技术全栈问答解析

互联网大厂Java求职面试实战:微服务、缓存与AI技术全栈问答解析 本文以互联网大厂Java求职者谢飞机与严肃面试官的对话形式,真实还原面试场景,涵盖Java SE 8/11/17、Jakarta EE、Spring Boot、微服务架构、数据库ORM、缓存技术、消息队列、安…

作者头像 李华