一个本地小范围说话人识别组件,用于告诉家机当前说话人是主人、熟人、未知者或难以确定,不阻断语音转写,也不用于安全认证。

Stars

11

7 天增长

暂无数据

Fork 数

0

开放 Issue

0

开源协议

Apache-2.0

最近更新

2026-07-12

AI 仓库情报摘要
FR-AI / ANALYSIS

为什么值得关注

它完全本地运行,通过子进程隔离模型崩溃,只保存嵌入向量而不保存原始音频,明确声明不提供活体检测或安全保证,因此非常适合注重隐私的个性化语音界面。

适合谁使用

  • 开发隐私优先家用语音助手的开发者
  • 希望无需云端实现说话人感知交互的智能家居爱好者
  • 研究可替换声纹后端在受限环境下表现的研究人员
  • 寻求轻量级说话人识别组件的开源智能家居平台维护者

典型使用场景

  • 让家机根据说话人身份切换称呼和记忆,实现家庭成员间的个性化对话
  • 在多用户家庭中,为语音日记系统自动标记每条记录的说话者
  • 实现访客模式,对未注册说话人仅作匿名处理,不存储其数据

项目优势

  • 本地处理且通过 ONNX 子进程隔离,防止音频/ML 崩溃影响主语音管道
  • 隐私优先:仅保存归一化嵌入于 SQLite,不保留原始音频,不上传云端
  • 后端可替换:通过简单接口(model_id、embed)即可换用自定义模型,无需修改 API
  • 明确的失败模式:返回 'unavailable' 或 'unknown' 而非阻断转写,保证鲁棒性

使用前须知

  • 不用于安全认证或活体检测,易受重放和深度伪造攻击
  • 仅支持 1 位主人和最多 3 位熟人,不适合大规模部署
  • 在重叠语音、唱歌、极短片段或强背景音乐下表现不佳

README 快速开始

快速开始

项目描述

Local small-set speaker identification for personal assistant machines.

相关仓库与替代方案

根据分类、Topic 和编程语言匹配的相似项目。

lopopolo
精选
lopopolo GitHub avatar

harness-engineering

Harness Engineering is a methodology for improving coding agent outputs by carefully crafting the environment around them—providing curated context, tools, and executable constraints that encode an organization’s nonfunctional requirements and cumulative lessons.

AI 与机器学习AI 智能体
2,390
slvDev
精选
slvDev GitHub avatar

esp32-ai

A 28.9 million parameter language model runs on an $8 ESP32-S3 microcontroller entirely on-device, generating simple stories at about 9.5 tokens per second.

AI 与机器学习大语言模型
1,960
littledivy
精选
littledivy GitHub avatar

mimic

mimic captures traffic from any iOS or web app and automatically generates a Python client library that lets you call the app's API like a regular library.

AI 与机器学习
1,482