核心观点 - 语音输入正从辅助功能蜕变为AI时代核心交互范式,一个千亿级赛道正在重构人机交互底层逻辑 [5][47] - Wispr Flow从濒临倒闭的硬件公司转型为估值20亿美元的AI语音独角兽,是硅谷创业精神和AI应用层找到PMF的经典样本 [8][28] Wispr公司发展历程与融资 - 2021年由斯坦福毕业生Tanay Kothari和Sahaj Garg共同创办,最初研发“读脑耳机”硬件 [10][17][20] - 三年烧掉1400万美元后,于2024年7月18日停止硬件研发,团队从40人骤降至5人,办公室从2000多平米变得空荡 [21][22] - 转型后全力投入此前为硬件配套开发的语音输入软件Wispr Flow [24] - 2024年10月Mac版上线,2025年3月Windows版发布,同年6月iOS版推出,2026年2月Android版正式上线 [26] - 融资历程:种子轮460万美元(2021年11月)[6];种子+轮1000万美元(2022年10月)[6];A轮未披露(2024年1月)[6];A+轮1200万美元(2024年9月)[6];A++轮3000万美元(2025年6月)[6];A轮追加2500万美元(2025年11月,估值7亿美元)[7];B轮2.8亿美元(2026年8月,估值20亿美元)[5][6] - 累计融资额攀升至3.61亿美元,不到一年估值从7亿美元翻近三倍至20亿美元 [6][7] Wispr Flow产品与技术优势 - 核心功能:用户按住快捷键说话,松开后语音内容自动出现在鼠标所在输入框,无需切换应用,几乎适用于所有软件 [30] - 输入速度比手动打字快3-4倍 [31] - 核心指标是“零编辑率”,官方数据显示超过80%,用户反馈实际体验接近100% [34] - 技术支撑一:意图驱动转录,自动删除填充词、修正语义错误、自动添加标点符号,建立个性化“专属字典”消化行业术语和表达习惯 [35] - 技术支撑二:系统级集成与超低延迟,支持110多种语言零延迟转录,跨平台兼容Mac、Windows、iOS和Android [35] - 2026年8月发布首款自研语音模型Canto,在最困难测试条件下将单词错误率从30%以上降至5%-10%,日常听写需编辑比例降低30%-35% [36][37] - 整体错误率约10%,低于OpenAI Whisper的27%和苹果原生转录的47% [38] Wispr Flow市场表现与用户数据 - 截至2026年8月,用户通过Flow已写下超过600亿单词 [39] - 用户下载六个月后仍有80%保持活跃,一半以上用户用Flow完成超70%文字输入 [39] - 付费转化率高达19%,月收入环比增长60%,年收入已达380万美元 [40] - 用户基数同比增长100倍,12个月用户留存率达70% [40] - 触达《财富》500强中的270家企业,与125家企业签订企业客户协议,产品被“几乎所有”《财富》500强公司和超1万家企业使用 [41] Wispr新产品Notetaker - 2026年8月推出首款非听写新产品——AI会议记录助手Notetaker [42] - 功能包括一键录制会议、生成实时转录和对话摘要,提供会前简报、会中“我错过了什么”按钮、会后按主题组织的详细纪要 [44] - 能与Anthropic的Claude和OpenAI的ChatGPT等AI助手通过模型上下文协议集成 [45] 行业市场规模与趋势 - 2026年全球AI语音识别市场规模达412.7亿美元,预计2030年突破780亿美元 [47] - 全球语音与语音识别市场从2025年的190.9亿美元增长至2026年的237亿美元 [47] - 全球约84亿台活跃语音助手,超过一半智能手机用户每天进行一次语音搜索,约32%消费者已养成用语音而非打字搜索的习惯 [47] - AI对话框取代搜索框成为新流量入口,语音作为最自然、最高效、心理负担最低的信息输入方式,是流量再分配的核心抓手 [71] 行业竞争格局:创业公司 - 智谱AI:2019年6月成立,2025年12月发布并开源GLM-ASR系列语音识别模型,推出同名输入法(产品代号AutoGLM),支持云端高精度与端侧轻量化部署,字符错误率低至0.0717,端侧模型参数量仅1.5B [48][49] - 闪电说(前身“代体”):2025年12月成立,端侧优先AI语音输入法,延迟小于200ms,输入速度每分钟220字,支持离线识别和多语种,内置AI引擎可自动优化句子结构,支持编程语言语法识别与符号补全 [48][53] - Typeless:2025年底上线,AI语音输入工具,支持100多种语言,自动去除语气词、调整语气风格,承诺零云端数据保留,2026年3月A轮融资1.2亿美元 [48][54][56] - Superwhisper:2023年7月成立,AI听写应用,支持自带API密钥接入OpenAI、Anthropic等多方模型及本地Whisper模型,覆盖桌面和iOS双端,截至2026年5月仍为自筹资金运营,未接受外部投资 [48][58][60][61] - Willow Voice:2025年成立,AI语音键盘,兼容macOS所有应用,结合上下文识别处理专业术语,自动纠正语法、去除填充词,2025年7月天使轮融资420万美元 [48] 行业竞争格局:科技巨头 - 谷歌:2026年5月发布基于Gemini的AI语音听写功能Rambler,深度集成至安卓原生输入法Gboard中 [64] - 微软:在Windows 11中推出Fluid Dictation(智能语音听写)技术,通过设备端小型语言模型实时修正语法、标点及冗余词 [64] - 苹果:在iOS 27开发者测试版中引入新一代AI听写功能,由设备端“AFM Core Advanced”大语言模型驱动,支持离线运行 [64] - 字节跳动:2025年下半年正式推出豆包输入法,将AI豆包植入输入法键盘 [65] - 讯飞听见:科大讯飞旗下产品,2016年面世,支持24种语言及17个专业领域效果优化,2025年财报显示APP连续三年毛利增长超60%,新增用户年续订率超50%,截至2026年3月累计覆盖用户数达1亿 [66] - OpenAI:2025年11月取消独立“语音模式”入口,将实时语音与视觉输出直接嵌入ChatGPT主聊天窗口 [66] - ChatGPT每周活跃用户数在2025年2月突破4亿,相比2024年8月的2亿不到半年实现翻倍,其中1.75亿用户通过移动设备访问;到2025年底攀升至约7-8亿 [67] - ChatGPT月度网站访问量从2024年夏季约20亿次飙升至2025年6月超过50亿次,实现160%同比增长 [69] 创始人背景 - Tanay Kothari:斯坦福大学毕业生,主修计算机科学,专注于人工智能与机器学习,曾在Andrew Ng的深度学习课程CS230担任助教,在斯坦福AIMI实验室参与医疗AI研究,研究成果发表于《npj Digital Medicine》 [12] - 2011年至2015年间发布七款移动和桌面应用,累计吸引来自17个国家超3万次下载 [12] - 创办音乐智能平台Convert.cc,零营销投入下做到月活250万用户 [13] - 创立电商个性化平台FeatherX,被Cerebra Technologies收购后担任产品负责人和工程负责人 [14] - 跻身2023年福布斯30 Under 30榜单 [16] - Sahaj Garg:斯坦福工程学院优等毕业生,后在光子计算公司Luminous Computing负责AI团队,与Kothari是大学室友 [17]
一家濒临倒闭的公司,2年估值飙到135亿,要让打字“消失”?
创业邦·2026-08-26 18:25