英文原标题:I created an interactive digital avatar of myself — and you can talk to it
本文为英文原文的机器翻译摘要,原文见:TechCrunch AI ↗
- Synthesia 为本文作者制作了其首个面向记者(也是除 Voica 外首次为外部人士)的数字分身,包括个人头像和交互式头像,后者仅基于作者关于风投支持创业公司欺诈的报道进行训练。
- 制作过程需在 Synthesia 办公室拍摄大量照片并录制两分钟语音,并签署同意书;团队用几天时间完成,交互式头像由语音转文本、视频、语言和文本转语音模型组合驱动。
- Synthesia 提供三类产品:经典头像的视频创作分发平台、可交互的 Sessions 代理平台,以及允许客户组合其视频和语音模型与其他服务的 API 平台。
- 作者体验后认为个人头像声音较准确,但交互式头像因确定性只能回答训练内容,朋友觉得声音和相似度不够像,母亲则称“神奇”并开玩笑说“我不记得生了两个你”。
- 作者由此思考新闻业未来:是否接受头像播报新闻、头像能否增强或取代记者,但强调新闻业最重要的信任无法外包给 AI;同时认为克隆自己对企业工作有吸引力,但对数字分身仍有复杂感受。
关键数据
- Synthesia 今年早些时候估值达 40 亿美元,去年称年度经常性收入超过 1 亿美元。
- 作者录制了两分钟语音样本,团队用几天时间制作头像。
- 交互式头像的模型可选用 Cartesia、ElevenLabs、Google 或 OpenAI 等替代方案。
引语
- “我不记得生了两个你。”
- “至少用头像,如果事情变得奇怪,我总能下线。”
为什么值得看:本文通过记者亲身体验 Synthesia 数字分身,展示了交互式 AI 头像在 PR 和新闻领域的应用现状,并引发对信任、真实性及新闻业未来的思考。