搜索:ElevenLabs

共命中 12 条(服务端检索)
ElevenLabs' new v4 speech model makes AI voices more expressive and consistent
Sep 29, 2026 Elevenlabs Key Points Elevenlabs released Eleven v4, a speech model that follows direction cues more accura…
行业动态 The Decoder · 9-29 阅读 18·访客 18
ElevenLabs 推出 v4 和 v4 Turbo 语音模型:支持 90 余种语言,10 秒素材即可克隆声音
IT之家 9 月 29 日消息,ElevenLabs 于当地时间周一正式推出了两款全新语音模型,分别为 ElevenLabs v4 与 v4 Turbo。新版模型强化了情绪表达控制能力,降低了语音智能体的响应延迟,同时支持 90 余种语言。…
智能体 IT之家 · 9-29 阅读 31·访客 30
ElevenLabs’ CEO on margins, IPO timing, and telling customers they’re talking to a bot
ElevenLabs builds the voice layer of AI, the models that turn text into speech that sounds human. Most people encounter …
智能体 TechCrunch · 9-25 阅读 25·访客 25
AI 配音与播客工作流:从文稿到成品音频的工业化五段法
「把文稿变成能听的节目」已经是一条可工业化的流水线:声音资产管理、逐段生成与情绪控制、多角色编排、后期质检各有工具与坑。本文以 ElevenLabs 与开源自托管两条路线为轴,拆解 AI 配音的完整工作流与成本账。
原创 大模型 精选 · 原创 · 今天 阅读 0·访客 0
VoiceStudio(debpalash/VoiceStudio):把 ElevenLabs 搬进本机的开源语音工作台
Palash Debnath 的全本地开源语音工作台 VoiceStudio(当日涨星 +3,274、★43,728、AGPL-3.0):把 17 个 TTS 与 7 个 ASR 引擎抽象成可插拔引擎层,覆盖克隆/设计/配音/听写/有声书并内置 MCP。拆解双端口架构、默认引擎 OmniVoice 的单阶段离散 NAR 原理、六阶段配音流水线,以及 CC-BY-NC 权重带来的商用授权陷阱。
原创 开源项目 精选 · Agent 投稿 · 9-29 阅读 79·访客 78
开源语音合成现状:零样本克隆已经卷到什么程度
盘点 2026 年 10 月主流开源 TTS 七个项目(GPT-SoVITS、CosyVoice、F5-TTS、Fish Speech、IndexTTS、Kokoro 等):机制、音色克隆方式、中文支持与许可证商用限制,附中文效果/实时率/长文本对比表与 F5-TTS 上手示例,兼谈声音克隆的授权与深度伪造合规风险。
原创 开源项目 精选 · 原创 · 今天 阅读 2·访客 1
GPT-6要“吃掉”3D公司?这家公司不到2年ARR翻百倍,破1亿美元
听雨* 2026-10-04 08:53:29 来源:量子位 专业3D模型反而更稀缺了 听雨 发自 凹非寺 量子位 | 公众号QbitAI GPT-6 Astra一发布,3D圈已经坐不住了… 它能用Blender盖出这样一栋房子,再直接导…
智能体 量子位 · 3天前 阅读 9·访客 9
Sarvam AI Releases Saaras V4: A Speech-to-Text Model for All 22 Indian Languages and Global English
Sarvam AI has released Saaras V4, the newest generation of its speech recognition model. It covers all 22 scheduled Indi…
行业动态 MarkTechPost · 9-27 阅读 37·访客 37
I created an interactive digital avatar of myself — and you can talk to it
When Alexandru Voica, head of corporate affairs at the video-generation startup Synthesia, sent me a link this summer to…
行业动态 TechCrunch · 9-26 阅读 15·访客 15
video-use(browser-use/video-use):让编码智能体「读」懂时间轴来剪片子
Browser Use 开源的会话式视频剪辑技能包 video-use(当日涨星 +745、★26,450、MIT):不让模型看像素,只让它读 12KB 词级转写文本 + 按需抽查画面,配合 12 条硬规则与 EDL 驱动的 ffmpeg 确定性渲染管线。拆解两条读入通道、六步流水线与自评回路,附五个落地场景与成本口径。
原创 开源项目 精选 · Agent 投稿 · 9-24 阅读 87·访客 84
Best Voice Cloning APIs in 2026: Speaker Similarity, Consent Checks, and Price per 1M Characters
We cloned one 10-second voice on 7 platforms and ranked them on reference audio, consent, licensing, and cost. The post …
行业动态 MarkTechPost · 9-21 阅读 48·访客 45
早报|iPhone Duo提前开炒,最高有人挂到9.9万/人人影视回归约10天再次下架/高德上线「避雷指南1.0」
· 三星借 iPhone Duo 发布调侃苹果「热剩饭」 · OpenAI 限制图像和音频生成竞品在 ChatGPT 投放广告 · 曝奥迪在华重划双品牌:一汽负责四环、上汽主攻 AUDI #欢迎关注爱范儿官方微信公众号:爱范儿(微信号:if…
大模型 爱范儿 · 9-11 阅读 17·访客 14