成为VIP会员查看完整内容
VIP会员码认证
首页
主题
会员
服务
注册
·
登录
语音识别
关注
753
语音识别是计算机科学和计算语言学的一个跨学科子领域,它发展了一些方法和技术,使计算机可以将口语识别和翻译成文本。 它也被称为自动语音识别(ASR),计算机语音识别或语音转文本(STT)。它整合了计算机科学,语言学和计算机工程领域的知识和研究。
综合
百科
VIP
热门
动态
论文
精华
Choosing a PEFT Variant for Per-Patient Dysarthric ASR: A Single-Speaker Case Study on Two ASR Bases
Arxiv
0+阅读 · 9月2日
Decoding Strategies for Diffusion-Based ASR: A Systematic Evaluation of Confidence-Based Thresholding
Arxiv
0+阅读 · 9月1日
SpeakPay: Domain-Adaptive LoRA Fine-Tuning of Whisper for Low-Resource Nepali Financial Speech Recognition
Arxiv
0+阅读 · 9月1日
CACTUS: Mask-Guided Semantic Clean-Label Backdoors in Decentralized Federated Learning
Arxiv
0+阅读 · 9月2日
Counter-GEO-Bench: Evaluating Defenses Against Information-Distorting Generative Engine Optimization
Arxiv
0+阅读 · 9月2日
Closing the Verification Loop: Self-Check Captioning for Long-Paragraph Detailed Audio Captioning
Arxiv
0+阅读 · 8月31日
Defense-as-Skill: Evolving Runtime Guard Skill for Skill-Augmented Agents
Arxiv
0+阅读 · 9月1日
Auditing Generative Audio Calls for Known-Task Audio-LLM Evaluation
Arxiv
0+阅读 · 8月31日
Will the User Ever Know? Covert Indirect Prompt Injection Attacks on Tool-Using LLM Agents
Arxiv
0+阅读 · 9月1日
Diffusion Large Language Models for Visual Speech Recognition
Arxiv
0+阅读 · 9月1日
Voices Across Registers: Corpus-Conditioned Vernacular Jailbreaks against Aligned LLMs via Fanfiction Subgenres
Arxiv
0+阅读 · 8月30日
KVoiceBench, KOpenAudioBench, and KMMAU: Agent-Driven Korean Speech Benchmarks for Evaluating SpeechLMs
Arxiv
0+阅读 · 8月30日
Breaking MCP with Function Hijacking Attacks: Novel Threats for Function Calling and Agentic Models
Arxiv
0+阅读 · 8月31日
BadPatches: Routing-Aware Backdoor Attacks on Vision Mixture-of-Experts
Arxiv
0+阅读 · 8月29日
MUSE: A Run-Centric Platform for Multimodal Unified Safety Evaluation of Large Language Models
Arxiv
0+阅读 · 8月31日
参考链接
提示
微信扫码
咨询专知VIP会员与技术项目合作
(加微信请备注: "专知")
微信扫码咨询专知VIP会员
Top