-
Shotcut 26.9 视频编辑器改进了 Linux 系统上的 VA-API HEVC 硬件编码器
Shotcut 26.9 今天发布,这是这款开源、免费、跨平台的视频编辑软件的最新稳定版本,该软件使用 Qt 编写,并采用 MLT 多媒体创作框架。 Shotcut 26.9 在 …
-
ZEGO 实时互动 AI Agent 2.14.10 新增支持 ElevenLabs TTS 模型
ZEGO 实时互动 AI Agent 2.14.10 版本发布,本次版本核心亮点是新增 ElevenLabs TTS 供应商和数字人实例支持透明通道等功能。 新增 ElevenLa…
-
综合性能全球第一!海马云自研 RH Upscale 超分模型正式登陆 RunningHub
刚刚,海马云自研超分模型RH Upscale全球首发上线,旗下全能内容创作平台RunningHub已经全面接入。 在包含RH Upscale五档模式,以及Topaz Astra 2…
-
Glia 正在打造的,远不止一个联络中心
在过去十年的大部分时间里,客户体验(CX)行业一直在试图解决一个”渠道问题”。语音需要和聊天打通,聊天要和消息打通,消息要和数字化打通,而这一切最终还得接回…
-
IEEE 宣布颁发 HEVC/H.265 开发领导力奖
电气与电子工程师协会 (IEEE) 宣布,2027 年 IEEE Arun N. Netravali 视频分析、技术和系统奖将颁发给 Benjamin Bross、Jens-Rai…
-
预测:2026 年亚洲视频内容投资将达 150 亿美元
Media Partners Asia(MPA)发布了《Asia Video Content Dynamics 2026》,这是其对亚洲七大市场(印度、印度尼西亚、韩国、马来西亚、…
-
报告:流媒体观众的注意力正在持续流失
TVision by Viant 发布了《2026 流媒体现状报告》,该报告基于全球规模最大的流媒体注意力监测样本库之一。其结论挑战了人们对观众在流媒体和线性电视上究竟把注意力放在…
-
别再把统一通信当产品卖:7 个需要避免的错误
统一通信(UC)早已从传统 PBX、语音中继和模拟电话的时代走出很远。既然通信技术在这么多年里发生了如此翻天覆地的变化,那我们销售这些解决方案的方式是不是也该跟着进化? 许多经销商…
-
AFP 与 Dalet 将 C2PA 标准引入视频和编码工作流
Dalet 与法新社(AFP)宣布达成合作,旨在强化整个新闻媒体生态中的内容溯源与真实性。 此次合作将 AFP 在内容上应用 C2PA(内容溯源与真实性联盟)标准的实践,与 Dal…
-
Sarvam AI 发布 Saaras V4:面向全部 22 种印度语言和全球英语的语音转文字模型
Sarvam AI 发布了 Saaras V4,这是其语音识别模型的最新一代。它覆盖全部 22 种印度法定语言以及英语,现在还纳入了全球各地的英语口音。Sarvam 称其在全部 2…
-
Disney+ Premium 法国会员将无法享受 HDR 和杜比视界服务
Disney+ 在取消其 Premium 订阅服务中包含的几项增强图像技术,但并未降低价格,因此正面临法国消费者团体 Que Choisir Ensemble 的正式挑战。 这些变…
-
VLC 3.0.24 修复了 130 多个安全漏洞,并升级到 FFmpeg 8.1.2
VLC 3.0.24 于 9 月 22 日发布,这是 VLC “Vetinari”分支的第二十五个版本。此次更新修复了 VLC 及其捆绑库中超过 130 个安全漏洞,并将内置的 F…
-
aec3-rs:把 WebRTC 的 AEC3 回声消除器搬进 Rust 生态
aec3(RubyBit/aec3-rs)是 WebRTC AEC3 声学回声消除器的 Rust 移植版本,但它不只是”翻译一遍 C++”——它把 AEC3…
-
SimpliSafe 的新款可视门铃,能把实时安保专员”调到”你家门口
SimpliSafe 推出了 Video Doorbell Series 2,这是一款售价 199.99 美元的门铃摄像头,在更清晰的 2K 视频和 AI 检测能力之外,还搭配了一…
-
语音 AI:语音正在改变软件的几种关键方式
语音已经成为与数字产品交互的一种越来越实用的方式。用户无需输入搜索词或层层点击菜单,而是可以直接对应用说话,获得回复或触发某个操作。现代语音 AI 把语音识别与能够理解口语输入、并…
-
OpenAI 将插件引入 Live Voice,并把语音能力带入 ChatGPT Work
根据 OpenAI 的 ChatGPT 发布说明,OpenAI 于 2026 年 9 月 23 日为网页端、iOS 和 Android 上 ChatGPT 的 Live Voice…
-
Aragon Research 将 Vonage 评为新定义的智能通信体验 (ICX) 类别中的主要提供商
全球云通信公司 Vonage 宣布,Aragon Research 已将其评为新定义的智能通信体验 (ICX) 类别中的主要提供商。 Aragon Research 发布了一份新的…
-
Adobe 完成对 AI 视频和图像增强公司 Topaz Labs 的收购
Adobe 已完成对 AI 视频和图像增强专家 Topaz Labs 的收购。此次收购价值 3.4 亿美元。 Topaz Labs 将继续作为独立品牌运营,Adobe 和 Topa…
-
流媒体服务如何在高峰需求期保持可靠性
当一部热门剧集在午夜一次性放出所有剧集,或者一场万众瞩目的足球决赛在多个时区同时开赛时,数百万观众会在同一短暂的时间窗口内点击播放。对于 Netflix、Pluto TV 及其竞争…
-
NVIDIA 发布 Nemotron 3 Diarization:一个拥有 1 亿个参数的开放式权重模型,可实时追踪 8 个说话者
NVIDIA 在 Hugging Face 平台上发布了Nemotron 3 Diarization,一个开源权重的说话人分离模型。它回答关于任何一段对话的一个问题:谁在什么时候说…