Boothic SMPC今日宣布推出Sayscroll,一款基于浏览器的AI提词器产品。该产品通过实时语音识别技术,使脚本滚动与演讲者的自然语速自动对齐,旨在替代传统提词器依赖手动操作或固定滚动速度的使用方式。
与以固定速度滚动脚本的传统软件不同,Sayscroll利用实时语音识别技术追踪用户说出的词语,并据此推进文本。系统在演讲者犹豫停顿时自动暂停滚动,在重复某句话时自动回退至相应位置,在演讲者偏离书面脚本时保持当前显示位置不变。Sayscroll创始人Nick Damofli表示,阅读脚本的同时在镜头前保持自然状态是一件相当困难的事,该产品的目标并非让人听起来像AI,而是让人更容易做自己。
数字视频制作正迅速成为一项必要的企业与创作技能。企业创始人需要录制产品演示,销售人员使用个性化视频消息进行客户沟通,教育工作者制作远程课程,独立创作者每日发布多媒体内容。这些从业者中许多人并未接受过正式的播音训练。与此同时,传统新闻编辑室使用的提词器设备历来依赖专职操作人员、脚踏板或遥控器来手动调整文本速度。在没有操作人员的情况下,独自出镜的演讲者往往只能被动适应固定的滚动速度。
Damofli补充表示,人们通常认为提词器是专业主持人的工具,但Sayscroll面向所有人设计,无论是第一次录制视频还是已经录制了上千次,一个能跟上演讲者节奏的提词器都有其使用价值。这一表态反映出当前视频创作工具市场的一个趋势:随着视频成为企业沟通和内容营销的主要媒介,面向非专业用户的轻量化制作工具需求正在增长。
在技术规格方面,Sayscroll采用跨平台语音识别引擎,能够识别超过60种语言。该软件可动态检测当前使用的语言,即使同一份脚本在演示过程中跨越多种语言,系统仍能正常追踪。产品专为独立制作场景设计,将语音追踪、提词器显示和视频录制功能整合于一体。
当前,人工智能正在加速生成自动化视频脚本和合成主持人,Sayscroll选择了一条不同的路径:利用技术辅助人类演讲者在镜头前更真实地表达。这一产品定位与市场上大量涌现的AI生成视频工具形成差异化。在企业服务领域,视频已成为销售、营销、培训和内部沟通的重要载体,围绕视频制作效率的工具链正在不断细分。从脚本生成到提词辅助再到后期编辑,各环节均出现了针对性的产品。Sayscroll切入的是提词这一具体环节,其语音识别驱动的交互方式能否在竞争激烈的创作者工具市场中建立差异化优势,取决于其识别准确率和多语言支持的实际表现。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。