字节 trust and safety
-
发布了文章 2个月前
SeedFoley – 字节推出的端到端视频音效生成模型
SeedFoley 是字节跳动豆包大模型语音团队开发的端到端视频音效生成模型,为视频创作提供智能音效生成服务。通过融合时空视频特征与扩散生成模型,实现音效与视频的高度同步。模型采用快慢特征组合的视频编码器,提取视频的时空特征...
-
发布了文章 2个月前
Agent TARS – 字节跳动开源的多模态 AI Agent 项目
Agent TARS 是字节跳动开源的多模态 AI 代理工具。基于视觉解释网页内容,与浏览器、命令行和文件系统无缝集成,实现复杂任务的规划与执行。Agent TARS 提供桌面客户端,展示多模态元素和对话流程。Agent T...
没有更多内容





