本周集简云上线了内置应用— **文本语音转换** 。目前支持OpenAI TTS和TTS HD模型,实现文本语音高效智能转换,也可根据你的产品或品牌创建独特的神经网络定制声音。 **应用场景**文本转语音将文本信息实时转化为近似的真人发声,为文本配上“说话”的能力。满足您的定制化需求,例如:* **有声读物**:将书籍、杂志、新闻的文本内容转换成逼真的人声发音,充分解放人们的眼睛,在搭乘地铁、开车...
是国内领先的拥有文本、语音、视觉三模态融合的千亿参数语言大模型,并打通产品全链路的创业公司。![picture.image](https://p6-volc-community-sign.byteimg.com/tos-cn-i-tlddhu82om/43436267efb5456... 文本转化为高维向量接口,可实现如长记忆检索、知识库检索等能力; **T2A(语音合成)**:基于自然语言交互生成能力的文字转语音接口。 其中, **Chat Completion Pro**...
百度文心绘图等300余款AI图像生成模型。**嵌入集成:**提供页面嵌入,API调用,嵌入企业微信/钉钉/飞书OA系统,接入微信公众号、抖音,集简云(流程对接)等方式,将语聚AI的能力服务于您的内部与外部用户。... 实现实时智能问答对话助手集成了多种大语言模型,包括:ChatGPT,文心一言,Google Palm2,,MiniMax,ChatGLM等。您可以切换不同的语言模型进行对话。同时,对话助手添加了“搜索引擎”功能,支持搜索实时的网络...
**新增超过300个图像生成模型限时免费使用**AI图像生成是集简云的一款内置应用,具有强大的图像处理功能。可以为用户快速、准确地生成高质量图片。无论是文字生成图片,还是图片生成图片、或者是对一幅图像进... **高效语音转换为文本**微软语音识别是集简云提供的语音转文本内置应用,可实现提取语音文件中内容并转换输出为文本,适用于会议记录、语音助手、实时翻译等多种工作生活场景。且能够与第三方系统无代码集成,开...
下载地址Demo 下载地址,参看下载和体验场景化 demo。 体验说明由于语音聊天室场景体验 APP 涉及房主、嘉宾和观众角色,建议至少准备两台手机,以获得最佳体验: 下载安装体验包 登录-选择场景模块-【语音聊天室】进入,一台手机点击【创建直播】创建一个直播间 ,另一条手机进入该直播间 点击空麦位/底部连麦 icon,邀请直播间内观众上麦 点击底部音乐 icon,主播可以在房间内播放背景音乐,通过滑动音量条来调节音量 观众可点击空麦位,上...
主持人通过直播伴侣开始观众连麦后,观众可以申请连麦,从而实现主持人与观众的实时语音、视频互动,提高直播间的互动性和活跃度。 效果演示 角色介绍角色 描述 主持人 连麦和直播的发起方,拥有锁定观众镜头及移除... 应用场景教培直播公开课老师与观众连麦互动,有助于提升观看体验,从而提高课程转化率。 网课老师与学生连麦互动,有助于活跃课堂气氛并得到教学成果的即时反馈。 活动直播:在讲座、行业峰会、讨论会等场景下,与...
2023-11-23 广告位设置 实时抽奖 抽奖主题新增不展示抽奖动画选项。 修复部分体验问题。 2023-11-23 实时抽奖 服务端 API 新增部分接口。 2023-11-23 API 发布历史 直播伴侣 v1.40 优化连麦布局切换逻... 直播间标签 观看页体验优化 屏蔽系统通知开关更名为屏蔽互动特效。 优化观看页展示效果。 2023-10-17 礼物打赏安全管控 聊天互动 支持主持人手动编辑多语言文字评论。 2023-10-17 聊天互动 Web 观播 SDK ...
2023-12-29 URL 批量拉取上传完成 最佳实践 新增使用 veImageX 实时处理点播空间存储图片 20230-12-22 使用 veImageX 实时处理点播空间存储图片 PC 端上传客户端 更新安装包,升级为 1.7.4 2023-12-21 PC 端上传客... 合作的产品有视频直播、实时音视频、智能处理等新增:在进行媒资上传时,新增服务端 API、服务端 SDK、客户端上传 SDK、源站迁移工具的提示优化:可选时间范围由 93 天优化为 90 天新增:费用说明提示 2023-04-21 概...
为远端流开启镜像 setRemoteVideoMirrorType setRemoteVideoMirrorType:withMirrorType: setRemoteVideoMirrorType:withMirrorType: setRemoteVideoMirrorType setRemoteVideoMirrorType 转推直播功能新增以下特性... 可对房间内说话人的语音进行识别,转成文字或者进行翻译。使用该功能前,你需要开通机器翻译服务并前往 RTC 控制台,在功能配置页面开启字幕功能。接口参看: 平台 Android iOS macOS Windows Linux Electron 接口 st...
精准地生成视频字幕、提取字幕流。 通过语音转写为视频增加字幕。 通过机器翻译生成中文/英文字幕。 说明 字幕流提取主要应用于源视频包含字幕流(如 MKV)的场景; 若源视频无字幕或无法识别到字幕语言,则无字幕效果输出。 使用场景视频点播的智能字幕模板支持对视频、音频文件的多语音识别生成字幕以及实时语音识别的功能。使用的场景如下表所示。 场景 说明 实时直播/赛事/演唱会 生成单语/多语字幕。 视频/音频录制资料 生成单...
语音通话场景下发送 SEI 信息,调用 sendSEIMessage 接口后,SDK 内部会生成黑帧视频用于发送 SEI 信息,并通过 onSEIStreamUpdate 事件回调远端用户黑帧视频流的发布状态。 功能优化开启音频选路后,支持本端发布的音... 问题修复删除了头文件和文档中两个实时消息相关错误码 USER_MESSAGE_EXCEED_MAX_LENGTH 和 USER_MESSAGE_EMPTY_USER,相应的错误实际是通过 INVALID_PARAMS 抛出,例如, SDKError('INVALID_PARAMS', 'The message ...
是国内领先的拥有文本、语音、视觉三模态融合的千亿参数语言大模型,并打通产品全链路的创业公司。![picture.image](https://p6-volc-community-sign.byteimg.com/tos-cn-i-tlddhu82om/43436267efb5456... 文本转化为高维向量接口,可实现如长记忆检索、知识库检索等能力; **T2A(语音合成)**:基于自然语言交互生成能力的文字转语音接口。 其中, **Chat Completion Pro**...
2024-04-28 Web 观播 SDK 发布历史 实时抽奖 新增单次抽奖支持配置多个奖品。 新增奖品数量开关,用于在观看页展示或隐藏奖品的数量。 2024-04-23 实时抽奖 数据统计 一键复制直播间链接 新增支持一键复制... 超低延时直播和直播时移功能,以及支持直播时移功能等。 2024-03-28 iOS 观播 SDK 发布历史 自定义表情包 新增支持自定义表情包功能。 2024-03-14 聊天互动 聊天互动 新增支持观众删除自己发送的文字评论、...