消息来源频道

硬核开源智库

@HardcoreOpenAI

频道811 位成员公开可见持续更新

提供硬核学习资源,探索开源力量,驾驭AI未来! 本频道精选GitHub优质开源项目、最新人工智能(AI)技术进展、前沿科技资讯以及各类有价值的学习资源,助你站在技术浪潮之巅,实现知识与技能的快速跃迁。无论你是开发者、AI爱好者还是技术探索者,都能在这里找到属于你的宝藏!

成员规模811 位成员
在线情况待同步
消息总数1,140 条消息
浏览量总数116,736 次浏览

在这个频道里搜索消息……

t.me/HardcoreOpenAI

CI-VID:首个支持多剪辑连贯视频生成的大规模文本视频混合数据集,突破传统单剪辑配对局限,赋能故事驱动的视频生成技术。
• 超340,000条视频剪辑与丰富字幕交织序列,覆盖334k训练样本+8k测试样本,助力模型同时掌握片内内容与片间时序关系
• 支持Text+Video→Video生成,强化时间和视觉连贯性,推动多场景叙事视频生成质量跃升
• 多维评测体系融合:专业人类评审、基于视觉语言模型(VLM)自动评估、以及客观相似度计算,保障模型性能多角度验证
• 精细数据构建工具:基于相似性和主体实体分割视频,分层生成单剪辑及跨剪辑转场字幕,确保数据结构严谨丰富
• 公开部分视频样本与评测代码,完整6.5TB数据集托管于 Hugging Face,适合深度研发与模型微调
• 专注科研非商业许可,避免数据滥用,确保学术环境下的公平与透明
CI-VID带来更具连续性和叙事性的多剪辑视频生成新范式,适合推进视觉叙事AI、视频理解与生成领域的长期探索与创新。