2025年最佳的 34 个AI语音转文本工具

FunASR
Funasr
FunASR是一款语音离线文件转写服务软件包,集成了语音端点检测、语音识别、标点等模型,能够将长音频与视频转换成带标点的文字,并支持多路请求同时转写。它支持ITN与用户自定义热词,服务端集成有ffmpeg,支持多种音视频格式输入,并提供多种编程语言客户端,适用于需要高效、准确语音转写服务的企业和开发者。
AI语音转文本
69.6K
AsrTools
Asrtools
AsrTools是一款基于人工智能技术的语音转文字工具,它通过调用大厂的ASR服务接口,实现了无需GPU和复杂配置的高效语音识别功能。该工具支持批量处理和多线程并发,能够快速将音频文件转换成SRT或TXT格式的字幕文件。AsrTools的用户界面基于PyQt5和qfluentwidgets,提供高颜值且易于操作的交互体验。它的主要优点包括调用大厂接口的稳定性、无需复杂配置的便捷性、以及多格式输出的灵活性。AsrTools适合需要快速将语音内容转换成文字的用户,特别是在视频制作、音频编辑和字幕生成等领域。目前,AsrTools提供免费使用大厂ASR服务的模式,对于个人和小团队来说,可以显著降低成本并提高工作效率。
AI语音转文本
114.0K
园丁提词器
园丁提词器
园丁提词器是一款专为直播、演讲、教学等场景设计的桌面提词器应用。它通过智能语音识别技术,实时感知用户语速,智能调节文本滚动速度,确保提词与表达同步。产品融合尖端AI技术,提供文案优化、全渠道提取文案、无水印视频下载、违禁词检测、文案配音等功能,显著提升文本创作效率。园丁提词器支持多窗口同步播放,满足多样展示需求,所有窗口均可置顶,避免遮挡,实现真正的隐形提词。产品背景信息显示,园丁提词器历经万场直播考验,稳定耐用,团队持续创新,稳定迭代,提供卓越服务。
AI语音转文本
65.4K
Kaption AI
Kaption AI
Kaption AI是一款Chrome浏览器插件,它利用人工智能技术将WhatsApp上的音频消息转换成文字,并提供消息摘要和回复建议。这款插件重视用户隐私和安全性,采用先进的AI技术实现准确的转录和总结。它特别适合那些经常使用WhatsApp且难以听取长音频消息的用户,帮助他们节省时间,只关注重要的信息。
AI语音转文本
49.1K
国外精选
Rev AI
Rev AI
Rev AI提供高精度的语音转录服务,支持58种以上语言,能够将视频和语音应用中的语音转换为文本。它通过使用世界上最多样化的声音集合进行训练,为视频和语音应用设定了准确性标准。Rev AI还提供实时流媒体转录、人类转录、语言识别、情感分析、主题提取、总结和翻译等服务。Rev AI的技术优势在于低词错误率、对性别和种族口音的最小偏见、支持更多语言以及提供最易读的转录文本。此外,它还符合世界顶级的安全标准,包括SOC II、HIPAA、GDPR和PCI合规性。
AI语音转文本
66.5K
Youtube-Whisper
Youtube Whisper
Youtube-Whisper是一个基于Gradio的应用程序,它通过提取YouTube视频的音频并使用OpenAI的Whisper模型来转录成文本。这个工具对于需要将视频内容转化为文本以进行分析、存档或翻译的用户来说非常有用。它利用了最新的人工智能技术,提高了视频内容的可访问性和可用性。
AI语音转文本
62.4K
优质新品
babelfish.ai
Babelfish.ai
babelfish.ai 是一个基于浏览器的实时语音转文字和翻译应用。它利用 Huggingface Transformer.js 和 Supabase Realtime 技术,实现了本地化的实时语音识别和多语言翻译功能。该应用支持将语音实时转换为文本,并能将文本翻译成200种语言,极大地提高了跨语言沟通的效率和便捷性。
AI语音转文本
52.4K
WeST
West
WeST是一个开源的语音识别转录模型,以300行代码的简洁形式,基于大型语言模型(LLM)实现语音到文本的转换。它由一个大型语言模型、一个语音编码器和一个投影器组成,其中仅投影器部分可训练。WeST的开发灵感来源于SLAM-ASR和LLaMA 3.1,旨在通过简化的代码实现高效的语音识别功能。
AI语音转文本
51.9K
aTrain
Atrain
aTrain是由格拉茨大学商业分析与数据科学中心的研究人员开发,并由格拉茨知识中心的研究人员测试的一款离线语音转录工具。它利用最新的机器学习模型,无需上传任何数据即可自动转录语音录音。aTrain在《行为与实验金融学杂志》上发表的论文中被介绍,如果用于研究,请引用该论文。它支持Windows 10和11系统,用户可以通过Microsoft应用商店或BANDAS中心网站下载安装。对于Linux系统,提供了Wiki上的安装指南。aTrain的主要优点包括无需上传数据的隐私保护、高质量的转录质量、以及在本地计算机上的快速处理速度。
AI语音转文本
63.5K
中文精选
视频提取文字工具
视频提取文字工具
AIbase视频提取文字工具是一个利用人工智能和机器学习技术,为用户提供快速、准确的视频文字转录服务。它优化了文字排版,使得转录内容易于理解且忠实于原视频。作为一项基础服务,该工具完全免费,无需安装、下载或付费订阅,极大地方便了创意人员的视频内容处理工作。
AI语音转文本
220.0K
中文精选
音频提取文字工具
音频提取文字工具
AIbase音频提取文字工具利用人工智能技术,通过机器学习模型快速生成高质量的音频文本描述,优化文本排版,提升可读性,同时完全免费使用,无需安装、下载或付款,为创意人员提供便捷的基础服务。
AI语音转文本
78.4K
Voice Pen
Voice Pen
Voice Pen是一款利用人工智能技术将语音转换为文字的应用程序,它支持超过50种语言,使用OpenAI的Whisper技术提供完美的转录和标点。用户可以使用Voice Pen记录语音,生成笔记、摘要、电子邮件、消息、博客帖子等。此外,它还具备AI重写功能,帮助用户清晰地组织文本、总结、制作列表、创建博客/帖子/推文、Instagram标题和电子邮件。Voice Pen注重用户隐私,不收集任何录音或文本数据。
AI语音转文本
64.3K
Transkriptor Transcribe Audio to Text
Transkriptor Transcribe Audio To Text
Transkriptor是一款将音频转换为文本的浏览器插件。它使用先进的人工智能技术,可以自动记录和转录会议、访谈和讲座等不同类型的语音内容。Transkriptor具有简单直观的界面,支持多种文件格式,提供安全的转录服务,并具备生成字幕、支持多语言转录和远程协作编辑等功能。
AI语音转文本
107.1K
Summify - Summarize speech
Summify Summarize Speech
Summify - Summarize speech是一款移动应用程序,可以让您轻松记录和总结任何演讲,从大学讲座或学校课堂到人工智能商务会议!它利用 OpenAI 的 Whisper AI 模型和 ChatGPT 的强大功能,以尽可能高的准确性转录文本并进行总结,捕捉每一个重要细节。Summify可以帮助您提高生产力,集中注意力,在家修改演讲内容,并保护您的隐私。
AI语音转文本
61.5K
Whisper Memo Dictation
Whisper Memo Dictation
使用先进的人工智能技术,将语音备忘录转录为文字。该应用能够轻松处理大型音频录音并生成准确的转录。支持离线转录,所有数据在设备上进行处理。免费功能包括:轻松录制和转录音频文件、无需互联网进行转录、所有数据在设备上处理、即时获取转录结果、自动检测语言、支持 5 个转录结果,界面简单易用,支持后台录制和分享转录结果至邮件和其他应用。Pro 功能包括无限次转录结果生成。立即下载!
AI语音转文本
51.1K
VoiceRec
Voicerec
VoiceRec 是一款集语音录制、转文字识别与共享于一体的人工智能语音应用。支持语音转文字、精准识别、支持多国语言、支持导出多种格式。
AI语音转文本
62.1K
Transcribe
Transcribe
Transcribe ~ Speech to Text是一个语音转文字的iOS应用程序。它利用OpenAI的Whisper技术和Apple的神经引擎,实现语音文件的高精度识别,可将音频和视频文件直接转录成可阅读的文本。支持离线识别和云端识别两种模式。适用于各类语音转文字的需求,使用简单方便。
AI语音转文本
86.7K
Whisper Notes
Whisper Notes
Whisper Notes 是一款准确的语音转文字工具,使用 OpenAI 的 Whisper 模型。无需网络连接,用户数据不会上传,支持 80 多种语言。可以用于记笔记、快速发送消息等。
AI语音转文本
217.8K
TextScan AI
Textscan AI
TextScan AI是一款免费的移动应用程序,可以从图像中轻松转换文本并与AI聊天,让您告别手动输入,享受更快速、更准确的聊天体验。它提供了智能的消息功能,让您与AI聊天更加便捷。TextScan AI是一款智能、高效的聊天工具,让您的聊天更加智能、高效。
AI语音转文本
51.1K
TranscribeAI
Transcribeai
TranscribeAI是一款革命性的Mac应用程序,旨在轻松将音频文件转录为文本。采用最先进的人工智能技术,该应用程序提供了无与伦比的准确性和速度,节省了您宝贵的时间和精力。无论您是记者、研究人员、内容创作者还是需要定期转录音频的人,TranscribeAI都是您的完美工具。
AI语音转文本
81.7K
VNSplit
Vnsplit
VNSplit是一款AI语音笔记摘要工具,可以在几秒钟内为您提供强大而详细的语音笔记摘要。通过AI发送语音笔记摘要,摆脱在iMessage和Whatsapp上听语音笔记的一切繁琐。只需订阅任何计划并提供您的iMessage或Whatsapp号码给Stripe,您将收到AI机器人的消息。将来的消息转发到该号码即可。
AI语音转文本
55.2K
Speechless
Speechless
Speechless 是一款基于 OpenAI 的 Whisper API 的终极应用,提供无缝的音频转录和翻译功能。通过 Speechless,您可以轻松导入音频并即时获取准确的转录。通过实时翻译打破语言障碍,轻松分享您的转录内容,实现无与伦比的连接和沟通。Speechless 支持 WhatsApp、语音备忘录等应用,让您轻松转录或翻译音频。
AI语音转文本
51.1K
WisprNote
Wisprnote
WisprNote 是一款智能语音转文字工具,支持将语音备忘录、音频和视频文件转录为纯文本。它拥有极高的准确性和转录速度,同时保证了隐私安全。适用于会议记录、访谈转录、学习笔记等场景。
AI语音转文本
59.3K
ALog
Alog
ALog是一个通过智能语音转文字和AI技术,帮助用户记录生活点滴的创新日记应用。具有语音录入日记、智能转录文本、情感分析、生活数据统计等功能,让用户随时随地记录生活。适用于希望通过语音形式记录生活的用户。
AI语音转文本
67.6K
Live Transcribe: Voice to text
Live Transcribe: Voice To Text
实时转写是一款能够实时将语音转为文本的应用程序,通过 iPhone 即可轻松进行语音记录。
AI语音转文本
62.1K
Call Recorder & Transcriber
Call Recorder & Transcriber
这是一个可在苹果和安卓手机上录制电话通话的应用程序。它使用IVR技术以最佳质量录制通话,还能使用机器学习和人工智能技术将录音转录成可阅读的文本文档,包括语音分离、时间码等。主要功能有:高质量录制通话;可转录通话生成文本文件;可通过邮件分享录音和文本文件;购买额外时长;没有广告,不需要订阅。
AI语音转文本
43.6K
Free AI Voice: Best Text to Speech Tool
Free AI Voice: Best Text To Speech Tool
免费AI语音是一款Chrome浏览器插件,利用文本转语音(TTS)技术将网页文章转换成语音,并支持40多种语言。适用于各种网站,包括新闻网站、博客、粉丝作品、出版物、教材、学校和课堂网站,以及在线大学课程材料。免费AI语音可以选择多种TTS声音,包括浏览器提供的声音。一些云端声音可能需要额外的应用内购买才能激活。免费AI语音适用于那些喜欢听内容而不是阅读的人,患有阅读障碍或其他学习障碍的人,以及正在学习阅读的儿童。
AI语音转文本
169.5K
NaturalReader - AI Text to Speech
Naturalreader AI Text To Speech
NaturalReader - AI Text to Speech 是一款Chrome插件,能够将在线文本转换成自然流畅的音频。只需点击播放,就可以让您的电子邮件、网页、PDF文件、Google文档和Kindle图书朗读给您听!通过使用我们的语音阅读器,用户可以节省时间,以比阅读更快的速度听取文本,并在无法阅读的时间提高工作效率,例如通勤、遛狗或做饭!免费版本功能丰富,还有两个付费高级套餐可供选择,适合各种预算。
AI语音转文本
89.7K
NaturalReader
Naturalreader
NaturalReader是一款全球领先的文本转语音解决方案。它提供个人、商业和教育用途的文字转语音功能,可以将文本内容自动转换为自然流畅的语音。其优势包括多语种支持、高质量音色、自定义语速和音调、多平台适用等。定价方案包括个人、教育和商业计划,满足不同用户需求。
AI语音转文本
51.6K
Speech to Text & Transcribe
Speech To Text & Transcribe
Speech to Text & Transcribe是一款实用工具,能够将口述的话语转换为书面文字,便于转录录音。借助开放式人工智能技术的进展,这类应用变得更加准确高效,甚至能够轻松转录低语的话语。 语音转文字的主要优势之一是能够将音频录音转换为文字。这对于记者、研究人员以及需要记录会议、采访或其他活动的人来说特别有用。该应用使用音频转换器读取音频文件并将其转换为文字,然后可以根据需要进行编辑和共享。 除了转录语音录音,语音转文字应用还可以用于口述,允许您直接在应用程序中说话并实时将其转录为文字。这个功能对于那些写作困难的人或需要快速高效地创建文本文档的人尤其有用。 总的来说,语音转文字应用是一种有价值的工具,可以节省时间并提高工作效率,使转录语音录音和创建重要事件的书面记录变得更加容易。随着开放式人工智能技术的进步,这些应用变得更加准确可靠,成为那些需要定期处理音频录音的人的必备工具。
AI语音转文本
48.0K
精选AI产品推荐
中文精选
NoCode
Nocode
NoCode 是一款无需编程经验的平台,允许用户通过自然语言描述创意并快速生成应用,旨在降低开发门槛,让更多人能实现他们的创意。该平台提供实时预览和一键部署功能,非常适合非技术背景的用户,帮助他们将想法转化为现实。
开发平台
98.3K
优质新品
ListenHub
Listenhub
ListenHub 是一款轻量级的 AI 播客生成工具,支持中文和英语,基于前沿 AI 技术,能够快速生成用户感兴趣的播客内容。其主要优点包括自然对话和超真实人声效果,使得用户能够随时随地享受高品质的听觉体验。ListenHub 不仅提升了内容生成的速度,还兼容移动端,便于用户在不同场合使用。产品定位为高效的信息获取工具,适合广泛的听众需求。
音频生成
81.1K
国外精选
Lovart
Lovart
Lovart 是一款革命性的 AI 设计代理,能够将创意提示转化为艺术作品,支持从故事板到品牌视觉的多种设计需求。其重要性在于打破传统设计流程,节省时间并提升创意灵感。Lovart 当前处于测试阶段,用户可加入等候名单,随时体验设计的乐趣。
AI设计工具
100.7K
FastVLM
Fastvlm
FastVLM 是一种高效的视觉编码模型,专为视觉语言模型设计。它通过创新的 FastViTHD 混合视觉编码器,减少了高分辨率图像的编码时间和输出的 token 数量,使得模型在速度和精度上表现出色。FastVLM 的主要定位是为开发者提供强大的视觉语言处理能力,适用于各种应用场景,尤其在需要快速响应的移动设备上表现优异。
AI模型
83.4K
国外精选
Smart PDFs
Smart PDFs
Smart PDFs 是一个在线工具,利用 AI 技术快速分析 PDF 文档,并生成简明扼要的总结。它适合需要快速获取文档要点的用户,如学生、研究人员和商务人士。该工具使用 Llama 3.3 模型,支持多种语言,是提高工作效率的理想选择,完全免费使用。
文章摘要
51.3K
KeySync
Keysync
KeySync 是一个针对高分辨率视频的无泄漏唇同步框架。它解决了传统唇同步技术中的时间一致性问题,同时通过巧妙的遮罩策略处理表情泄漏和面部遮挡。KeySync 的优越性体现在其在唇重建和跨同步方面的先进成果,适用于自动配音等实际应用场景。
视频编辑
79.2K
AnyVoice
Anyvoice
AnyVoice是一款领先的AI声音生成器,采用先进的深度学习模型,将文本转换为与人类无法区分的自然语音。其主要优点包括超真实的声音效果、多语言支持、快速生成能力以及语音定制功能。该产品适用于多种场景,如内容创作、教育、商业和娱乐制作等,旨在为用户提供高效、便捷的语音生成解决方案。目前产品提供免费试用,适合不同层次的用户。
音频生成
651.1K
中文精选
LiblibAI
Liblibai
LiblibAI是一个中国领先的AI创作平台,提供强大的AI创作能力,帮助创作者实现创意。平台提供海量免费AI创作模型,用户可以搜索使用模型进行图像、文字、音频等创作。平台还支持用户训练自己的AI模型。平台定位于广大创作者用户,致力于创造条件普惠,服务创意产业,让每个人都享有创作的乐趣。
AI模型
8.0M
AIbase
智启未来,您的人工智能解决方案智库
© 2025AIbase