Phonic是语音AI平台,可从Lux获得投资

AI生成的语音已经相当出色,你知道吗?它们完全胜任有声书、播客、朗读文章,甚至基本的客户支持。但很多企业仍对AI语音技术的可靠性持怀疑态度。
这时,MIT毕业生Moin Nadeem和Nikhil Murthy登场了。他们创立了Phonic,一家致力于提升合成语音可靠性并减少延迟的公司。这两位朋友相识超过七年,从MIT相识开始。去年创立Phonic时,他们发现市场上缺乏完整的语音技术解决方案。
“语音AI现在是将不同部分拼接在一起,比如自动语音识别和文本转语音,再加入一些智能,”Murthy对TechCrunch解释说。“但与真实客户交流后,我们发现能够大规模可靠处理事务的解决方案很匮乏。”
曾在MosaicML(2023年被Databricks以13亿美元收购)工作的Nadeem指出,语音AI领域的许多公司,如Vapi和Rounded,只是将不同的AI模型拼凑在一起。而Phonic则不同,他们从头到尾自主训练模型。Murthy认为这种方式有很大优势。
“当你拥有模型时,可以直接在模型中嵌入强大的可靠性功能,”他说。“如果不控制这一层,你只是在尝试将不完全匹配的部分粘合在一起。”
此外,Murthy提到,Phonic的方法让他们能够以成本效益高的方式托管和运行模型。他们在各种录音上训练模型,包括带口音和模糊的语音,以确保模型非常稳健。
目前,Phonic正与保险和医疗行业的一些特定合作伙伴合作,但他们正准备在几个月内进行更广泛的发布。Nadeem表示,很快任何感兴趣的人都可以直接从他们的网站体验Phonic的技术。
Phonic已成功获得400万美元的种子轮融资,由Lux领投,Replit联合创始人Amjad Masad、Hugging Face联合创始人Clem Delangue、Applied Intuition联合创始人Qasar Younis和Modal Labs创始人Erik Bernhardsson等大咖也参与其中。
Lux Capital的Grace Isford表示,他们被Phonic自主训练模型的独特方法所吸引。“我们认为Moin和Nikhil是出色的技术专家,”她说。“他们在MIT创立了机器学习俱乐部,并且一直在从事模型训练工作。他们在语音AI领域混合使用扩散模型和专有模型的方法非常创新。”
相关文章
谷歌在 Docs 和 Keep 中推出了语音提示功能
在谷歌I/O开发者大会上,该公司宣布将在Docs、Keep和Gmail等Workspace应用中引入语音提示功能。这些功能使用户能够通过语音创建草稿、记录笔记以及搜索邮件。在 Docs 中,用户可以完全通过语音起草文档。在 TechCrunch 展示的演示中,一位用户从 Drive 中提取了简历信息,从一封电子邮件中添加了活动安排,甚至还加入了几则幽默轶事。图片来源:谷歌此前,用户必须手动输入所有
高盛前员工与Meta创始人联手开发面向被忽视市场的语音AI
客户支持与服务是当今语音人工智能领域最热门的领域之一。但在某些市场,开发出声音逼真且响应延迟极低的产品要比其他市场困难得多——而大多数主要玩家在设计产品时并未将非洲和中东地区纳入考量。AethexAI是一家成立于去年、旨在弥合这一差距的初创公司,已获得由4DX Ventures领投、Enza Capital、Dorm Room Fund、Mojo Ventures和斯坦福大学商学院26号基金跟投的
谷歌在iOS平台上悄然推出了一款“离线优先”的AI语音输入应用
本周一,谷歌悄然在iOS平台推出了一款“离线优先”的语音输入应用——Google AI Edge Eloquent,以此与Wispr Flow、SuperWhisper、Willow等同类应用展开竞争。该应用可免费下载。下载基于Gemma的自动语音识别(ASR)模型后,您即可在手机上开始语音输入。应用会实时显示转录内容,暂停时会自动去除“嗯”、“啊”等口头语,并优化文本。在转录内容下方,“要点”、
相关专题推荐
评论 (51)
0/500
It's about time investors took notice! I've been using AI voice for my podcast intros and it's surprisingly natural now. But reliability for business? Still skeptical. 😅
AI音声がここまで自然になったのはすごい進歩だね😲 でもまだ多くの企業が信用に足るかどうか躊躇しているって紹介されてた通り、私も大事な顧客対応を全て任せるのはちょっと…と感じる。Phonicへの投資が実用性の向上につながるといいな。
AI voices are getting wild! Phonic’s tech sounds super promising for podcasts and support. Wonder how it stacks up against human voices in real-world chaos? 🤔
AI voices are getting wild! Phonic’s tech sounds super promising for podcasts and support. Excited to see where this investment takes them! 🎙️
Whoa, AI voices are getting so real! Phonic's tech sounds like it could make audiobooks way more immersive. Curious if they’ll tackle accents next—imagine a perfect British narrator for my favorite novels! 😄

AI生成的语音已经相当出色,你知道吗?它们完全胜任有声书、播客、朗读文章,甚至基本的客户支持。但很多企业仍对AI语音技术的可靠性持怀疑态度。
这时,MIT毕业生Moin Nadeem和Nikhil Murthy登场了。他们创立了Phonic,一家致力于提升合成语音可靠性并减少延迟的公司。这两位朋友相识超过七年,从MIT相识开始。去年创立Phonic时,他们发现市场上缺乏完整的语音技术解决方案。
“语音AI现在是将不同部分拼接在一起,比如自动语音识别和文本转语音,再加入一些智能,”Murthy对TechCrunch解释说。“但与真实客户交流后,我们发现能够大规模可靠处理事务的解决方案很匮乏。”
曾在MosaicML(2023年被Databricks以13亿美元收购)工作的Nadeem指出,语音AI领域的许多公司,如Vapi和Rounded,只是将不同的AI模型拼凑在一起。而Phonic则不同,他们从头到尾自主训练模型。Murthy认为这种方式有很大优势。
“当你拥有模型时,可以直接在模型中嵌入强大的可靠性功能,”他说。“如果不控制这一层,你只是在尝试将不完全匹配的部分粘合在一起。”
此外,Murthy提到,Phonic的方法让他们能够以成本效益高的方式托管和运行模型。他们在各种录音上训练模型,包括带口音和模糊的语音,以确保模型非常稳健。
目前,Phonic正与保险和医疗行业的一些特定合作伙伴合作,但他们正准备在几个月内进行更广泛的发布。Nadeem表示,很快任何感兴趣的人都可以直接从他们的网站体验Phonic的技术。
Phonic已成功获得400万美元的种子轮融资,由Lux领投,Replit联合创始人Amjad Masad、Hugging Face联合创始人Clem Delangue、Applied Intuition联合创始人Qasar Younis和Modal Labs创始人Erik Bernhardsson等大咖也参与其中。
Lux Capital的Grace Isford表示,他们被Phonic自主训练模型的独特方法所吸引。“我们认为Moin和Nikhil是出色的技术专家,”她说。“他们在MIT创立了机器学习俱乐部,并且一直在从事模型训练工作。他们在语音AI领域混合使用扩散模型和专有模型的方法非常创新。”
谷歌在 Docs 和 Keep 中推出了语音提示功能
在谷歌I/O开发者大会上,该公司宣布将在Docs、Keep和Gmail等Workspace应用中引入语音提示功能。这些功能使用户能够通过语音创建草稿、记录笔记以及搜索邮件。在 Docs 中,用户可以完全通过语音起草文档。在 TechCrunch 展示的演示中,一位用户从 Drive 中提取了简历信息,从一封电子邮件中添加了活动安排,甚至还加入了几则幽默轶事。图片来源:谷歌此前,用户必须手动输入所有
高盛前员工与Meta创始人联手开发面向被忽视市场的语音AI
客户支持与服务是当今语音人工智能领域最热门的领域之一。但在某些市场,开发出声音逼真且响应延迟极低的产品要比其他市场困难得多——而大多数主要玩家在设计产品时并未将非洲和中东地区纳入考量。AethexAI是一家成立于去年、旨在弥合这一差距的初创公司,已获得由4DX Ventures领投、Enza Capital、Dorm Room Fund、Mojo Ventures和斯坦福大学商学院26号基金跟投的
谷歌在iOS平台上悄然推出了一款“离线优先”的AI语音输入应用
本周一,谷歌悄然在iOS平台推出了一款“离线优先”的语音输入应用——Google AI Edge Eloquent,以此与Wispr Flow、SuperWhisper、Willow等同类应用展开竞争。该应用可免费下载。下载基于Gemma的自动语音识别(ASR)模型后,您即可在手机上开始语音输入。应用会实时显示转录内容,暂停时会自动去除“嗯”、“啊”等口头语,并优化文本。在转录内容下方,“要点”、
It's about time investors took notice! I've been using AI voice for my podcast intros and it's surprisingly natural now. But reliability for business? Still skeptical. 😅
AI音声がここまで自然になったのはすごい進歩だね😲 でもまだ多くの企業が信用に足るかどうか躊躇しているって紹介されてた通り、私も大事な顧客対応を全て任せるのはちょっと…と感じる。Phonicへの投資が実用性の向上につながるといいな。
AI voices are getting wild! Phonic’s tech sounds super promising for podcasts and support. Wonder how it stacks up against human voices in real-world chaos? 🤔
AI voices are getting wild! Phonic’s tech sounds super promising for podcasts and support. Excited to see where this investment takes them! 🎙️
Whoa, AI voices are getting so real! Phonic's tech sounds like it could make audiobooks way more immersive. Curious if they’ll tackle accents next—imagine a perfect British narrator for my favorite novels! 😄





首页






