产品主要功能和描述:基于浏览器的 EPUB 阅读器,具有文本转语音功能。推荐配合 edge 浏览器使用,以获得更真实的语音效果。


做了个内容提取插件 E2N (Everything to Notebook),支持 B 站 / 小红书 / YouTube 等平台,可同步到 Obsidian / Notion / 飞书 / NotebookLM。功能:抓网页正文,自动过滤广告;视频优先抓官方字幕,没字幕的抽音频给 AI 转录,YouTube 支持批量拉播放列表;图片交给 AI 做 OCR 识别;同时推多个知识库。
![[开源免费] 实时数字人 OpenTalking 项目演示](/_next/image?url=https%3A%2F%2Fstatic.rustpoint.com%2Fscreenshots%2F1214991.jpg&w=3840&q=75)
**产品名称**:OpenTalking **主要功能**: 1. **实时对话数字人产线**:OpenTalking旨在将多个技术模块(如LLM、TTS、STT、WebRTC、字幕事件、角色音色、用户打断、前端交互和数字人视频驱动模型)串联起来,使数字人能够进行实时对话。 2. **状态管理和事件同步**:处理数字人演示与产品之间的工程距离,确保各个环节(如语音识别、文本生成、音频驱动、视频播放等)能够高效协同工作。 3. **多种部署模式**:提供Mock模式用于快速验证整体流程,Local模式支持单机部署,OmniRT模式便于接入远端推理服务,Direct WebSocket模式则方便开发者对接自己的模型服务。 4. **前端交互配置**:允许开发者配置数字人角色、音色、LLM、TTS、STT以及数字人驱动模型,并查看模型连接状态。 5. **后端事件编排**:负责编排对话中的各种事件,包括用户输入、模型回复、语音合成、字幕生成、视频播放和打断控制。 6. **支持多种模型后端**:目前已包含WebUI前端、后端API、会话编排、多种模型后端模式、角色配置、字幕事件和基础的实时对话链路。 **描述**: OpenTalking是一个为实时数字人设计的开源框架,它不仅涉及简单的图像移动或音频驱动口型,而是致力于创建一个能够进行连续对话、易于部署和切换模型的系统。该框架通过整合多个关键技术模块,简化了数字人开发的复杂性,并提供了灵活的部署选项,以适应不同的开发需求和资源条件。随着LLM、TTS和STT技术的日益成熟,OpenTalking有望在AI新闻主播、在线客服、教育讲解等多个领域发挥重要作用。
产品名称:中国家庭称谓计算器-AI版 主要功能:帮助用户了解和计算中国家庭中的称谓问题。 描述:在春节快到的时候,如果你不确定如何称呼亲朋好友,中国家庭称谓计算器-AI版可以帮助你解决称谓问题。

产品主要功能:辅助颈腰椎病康复的体态相机小工具。 描述:借助陀螺仪稳定相机并打上日期时间偏角水印,实现标准统一和纵向变化对比,用于个性化居家康复体操动作调整和阶段性评估,特别适用于快速生长期孩子的脊柱侧弯情况。

产品主要功能:监控 IT 之家 RSS 新闻,匹配关键词后将新闻推送到手机手表手环。 产品描述:代码开源,部署简单,通过 ntfy.sh 实现关键词匹配推送。

产品主要功能和描述: 1. 支持自定义翻译模板,用户可以创建和编辑多种翻译模板,包括名称、源语言、目标语言,并使用特定的占位符(如 {{text}} / {{source_lang}} / {{target_lang}})。 2. 开源翻译软件,源码包含简单的提示词,可直接发送给任何AI模型进行翻译。 3. 构建了一个单文件HTML应用,使用Vue 3和Tailwind CSS通过CDN引入,无需额外构建步骤。 4. 由LLM驱动的翻译器,采用新粗野主义风格设计,具有奶油色纸质背景、黑色网格、4-6px粗黑边框和硬偏移阴影。 5. 提供多栏工作区,包括输入文本框和流式输出,支持Ctrl/Cmd+Enter运行,以及复制/清空按钮。 6. 右侧设置抽屉包含子标签页,用于API配置、模板编辑器(增删改名、语言选择、提示词编辑器)、导入/导出JSON文件(可选择是否包含API key,导入时支持覆盖/合并)。 7. 支持双语UI切换按钮,位于设置旁边,语言偏好持久化,状态指示器(READY/SETUP)带闪烁圆点。