注册并分享邀请链接,可获得视频播放与邀请奖励。

与「TTS」相关的搜索结果

TTS 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 TTS 的内容
大家看看这个数字人主播感觉怎么样?效果还可以不❓ 全程使用 codex 完成,没有切换其他软件。 具体制作流程如下👇 包含完整八步流程: 1.生成并固定数字人主播图片 2. 使用GeminiTTS、ElevenLabs或其他TTS服务确定音色 3.调研选题并撰写快节奏口播文稿 4.将文稿拆成视频生成提示词与B-roll规划 5.通过FLOVA、即梦/Dreamina或其他CLI/API后端生成视频 6.整合数字人片段、录屏和B-roll 7.在ChatCut中完成音频、动效、中英字幕和成片封装 8.生成4:3、3:4封面以及标题、简介和标签
显示更多
0
40
365
73
转发到社区
卧槽,真的被这个东西惊到了。 挖到一个叫 KrillinAI 的本地工具,免费,视频翻译、精准字幕、超自然配音、声音克隆,全流程一条龙搞定。 中英互翻效果特别稳, Whisper识别准确率高得离谱, LLM按段翻译上下文不乱, CosyVoice的TTS听着几乎像真人在说话。 支持Win和Mac,下载即用,还能直接用yt-dlp扒油管或者本地上传。 横屏竖屏自动适配,出海做内容的真的可以直接拿去用了。 以前为了翻一个视频又是剪映又是各种插件, 现在一个工具全搞定,字幕对齐干净,配音自然度超出预期。 免费、本地跑、无水印。
显示更多
0
100
1.3K
311
转发到社区
よみランプールわず!
0
50
4.4K
140
转发到社区
Introducing the Firecrawl plugin for Codex. Give Codex access to the most accurate search available (94.7% on SimpleQA) plus tools to scrape, crawl, and interact with any site. Find us on the @OpenAI plugin marketplace today!
显示更多
0
28
801
51
转发到社区
今天 GitHub 被逆向 Agent 彻底刷屏了! 5 个星标暴增、真正能落地的硬核项目,专业拆解下: 1. diegosouzapw/OmniRoute 
免费 MIT AI 网关:一个 endpoint 通吃 290+ 供应商(90+ 免费额度)、500+ 模型,配额感知自动 fallback + 强压缩,直接兼容 Claude Code / Cursor / OpenCode / Cline。 
🔗 直达: 
以前切模型像换 VPN,现在一个 endpoint 通吃,token 成本直接腰斩。网关赛道新王! 2. Optim-Agent/optim-agent 
把 LLM Agent 变成超参数优化器,自动帮你调模型、调工作流、调 prompt。 
🔗 直达: 
以前调参靠玄学,现在 Agent 自己跑实验、自己收敛。MLOps + Agent 的完美交叉点! 3. zhaoxuya520/reverse-skill 
AI 逆向 / 渗透 / 安全研究技能路由包。自动路由方法论 + 按需自举工具链 + 自进化知识库,原生支持 Claude Code、Cursor、Cline 等一众 Agent。 
🔗 直达: 
以前安全研究像手动堆工具箱,现在 Agent 自己挑刀、自己进化经验库。硬核到爆! 4. huggingface/speech-to-speech
本地语音 Agent 管道(VAD → STT → LLM → TTS),OpenAI Realtime 兼容,组件全可换,支持实时打断与工具调用。 
🔗 直达: 
真正能本地跑起来的实时语音对话 Agent,隐私和延迟双赢,开源玩家狂喜! 5. lyogavin/airllm 
单卡 4GB 就能跑 70B(甚至更大),层式加载,无需量化蒸馏。支持 Llama / Qwen / DeepSeek 等主流模型。 
🔗 直达: 
显卡乞丐也能养起大模型 Agent 的神器,本地推理直接起飞! // 总结 2026 年的风口已经从“会聊天的模型”全面转向“能干活、能进化、能本地落地的 Agent 基建”。谁先把这些玩透,谁就站在下一波生产力 C 位。
显示更多
0
47
53
18
转发到社区
Nếu vẫn chưa có ny... thì có khi sắp tới chỉ cần một con PC là đủ. 😂 Lướt bên cộng đồng AI của TQ thấy ae đang share nhau một bộ AI bạn gái ảo chạy local khá hay. Điểm mình thấy đáng chú ý là chạy 100% trên máy: ❌ Không cần Internet ❌ Không cần API ✅ Chạy local hoàn toàn 🛠️ Stack cũng toàn đồ quen mặt: 🔹 VAD: Silero VAD v5 🎙️ STT: Whisper 🧠 LLM: llama.cpp 🗣️ TTS: Qwen3-TTS Cả bộ chỉ cần khoảng 15GB VRAM. Mấy con RTX 5080, 5090 chạy khá thoải mái. Điều thú vị nhất là em này không chỉ ngồi chat "anh ăn cơm chưa?" 😆 Nếu em nó được cấp quyền, nó có thể: 🍔 Đặt đồ ăn. 🤖 Điều khiển robot hút bụi. 💡 Bật/tắt thiết bị nhà thông minh. 📱 Làm mấy việc hằng ngày thay mình. Framework dùng dạng speech-to-speech mã nguồn mở nên hội thoại khá tự nhiên, nói chuyện liên tục chứ không phải kiểu hỏi → đợi vài giây → mới trả lời như nhiều AI hiện nay. Nhìn tốc độ AI phát triển đúng là hơi rén thật ae ạ. Biết đâu vài năm nữa, người đầu tiên hỏi "hôm nay của bạn thế nào?" lại là AI chứ không phải người yêu. 😅 #AI# #Bangaiao#
显示更多
0
33
54
0
转发到社区
B站一兄弟做的赛博女友,太有感觉了! 纯本地运行的 AI 女友,不联网,不用 API key。 VAD:Silero VAD v5 STT:Whisper LLM:本地 llama.cpp TTS:Qwen3-TTS 四个模型全部塞进 15G 显存,且可自由热切换。 基于开源项目 speech-to-speech 改造。 我的codex啥时候能这样?😂
显示更多
0
139
2.2K
237
转发到社区
尝试复刻抖音上的书评号,一键出视频 声音:qwen TTS 0.6B的模型,我本地的m1跑的 文案:用微信读书skill爬的书评 图片:封面是微信读书skill取的,配图用的是 背景音乐: 纯血codex能力,不用任何花钱的api 这个是第一版,文案上还得打磨
显示更多
0
13
61
6
转发到社区
电商这套卖几万的系统被我搞到手了!! 配置比想象中低,效果比想象中好! 50系列显卡+32G以上内存。 就可以在本地搭一个数字人(形象克隆)+TTS(声音克隆)的短视频生产和数字人直播系统!! 就差显卡了,有点蠢蠢欲动!
显示更多
0
32
113
22
转发到社区
Qwen-Audio-3.0-TTS is here. 🎙️ Our latest text-to-speech model, in two flavors: • Flash: real-time interaction • Plus: high-quality generation What's new: • Multilingual coverage across 16 languages • Style control in natural language • Fine-grained tags for non-verbal details • More robust voice cloning from imperfect audio
显示更多
0
78
2K
224
转发到社区