Video Ocean V2.0:视频质量全面升级,依旧完全免费,薅羊毛的快乐等你来!

潞晨科技发布Video Ocean V2.0版本,全面升级画质、流畅度和功能玩法,并且免费提供给用户使用。新版本支持多种风格的视频生成,包括真人表现力更强的人物角色,以及3D角色效果出色的效果。此外,还提供了文生视频、图生视频和角色生视频等多种创作方式。

ACM Computing Surveys 港大等基于可靠性视角的深度伪造检测综述,覆盖主流基准库、模型

一篇深度伪造检测综述论文介绍了当前领域内的常用深度伪造基准数据库和代表性检测模型,提出了三个值得研究者们持续探索的话题和挑战(迁移性、可解释性和鲁棒性),并提出了一种新的评估深度伪造检测模型可靠性的方法。

如何高效桥接视觉和语言,字节&中大提出全新多模态大模型连接器ParGo

字节团队与中山大学合作提出的ParGo模型通过巧妙融合全局视野和局部细节,在多模态大语言模型中表现出色,成功入选AAAI2025。ParGo采用Partial-Global Perception Block和Cascaded Partial Perception Block模块,结合全局视角和局部细节处理视觉特征,有效提升了LLM的效果。