DeepSeek R1推理性能提升3.8倍,AMD发布下一代开源软件栈技术ROCm 7美光宣布在美投资增至2000亿美元,加建晶圆厂和HBM封装设施京东电竞惊喜日直播狂送百万福利 海量电竞装备618低至4折引疯抢曝鸿蒙智行智界、尚界将设独立销售渠道:正筛选经销商Sensor Tower:5月TikTok移动端海外月活首次突破10亿大关上汽安吉物流第二艘 9500 车位大船首航,将抵达英国等欧洲国家英特尔更新、更强锐炫独显现身,首次用上PCIe 5.0x16广明源222nm远紫外线消毒技术应用与解决方案甲骨文创始人埃里森跃居全球第二大富豪:超过贝索斯和扎克伯格,仅次于马斯克微软更新Mac版OneDrive应用,支持同步文件至移动硬盘微博:全面清理平台内违规 AI 教程及商品信息,从严打击滥用 AI 生成谣言等行为全国首创,湖南省手机应急呼叫平台正式启用小天才Z11升级了哪些地方?定位更准更好用,功能全面工信部印发《算力互联互通行动计划》加速发展:Gartner 预测生成 AI 应用将实现50% 的交付时间缩减谷歌AI助力气候预测:打破传统模型的局限,精确到 10 公里!联想华为加码!双层OLED普及加速,miniled要过气了?AMD与OpenAI联合发布强大AI芯片:推理性能提升35倍MiniMax Agent上线!图像生成+多语言支持 长任务处理更智能阿里开源在手机上运行的3D数字人应用:MNN TaoAvatar,可做虚拟客服、虚拟主播
  • 首页 > 云计算频道 > 大模型

    Sora平替?2分钟超长AI视频模型StreamingT2V免费开源

    2024年04月15日 11:31:45   来源:站长之家

      近日,Picsart AI Research等团队联合发布了一款名为StreamingT2V的AI视频模型,该模型能够生成长达1200帧、时长达2分钟的视频,这在技术上超越了之前备受关注的Sora模型。StreamingT2V的发布不仅在视频长度上取得了突破,而且它是一个免费开源的项目,可以无缝兼容SVD和animatediff等模型,这对于开源生态的发展具有重要意义。

      在Sora之前,市场上的视频生成模型如Pika、Runway、Stable Video Diffusion(SVD)等,通常只能生成几秒钟到十几秒的视频。Sora的出现以其60秒的视频生成能力成为行业的新标杆。而现在,StreamingT2V的推出,不仅在时长上有所突破,理论上还可以做到无限长,这为视频生成领域带来了更多可能性。

      StreamingT2V的架构采用了先进的自回归技术,能够创建具有丰富运动动态的长视频,同时保持视频的时间一致性和高帧级图像质量。与现有的文本到视频扩散模型相比,这些模型通常集中在高质量的短视频生成上,而在扩展到长视频时往往会出现质量下降、表现生硬或停滞等问题。StreamingT2V通过引入条件注意力模块(CAM)和外观保留模块(APM),以及一种随机混合方法,有效地解决了这些问题。

      CAM作为短期记忆块,通过注意机制调节当前一代的视频,以实现一致的块过渡;而APM作为长期记忆块,从第一个视频块中提取高级场景和对象特征,防止模型忘记初始场景。此外,StreamingT2V还利用高分辨率文本到视频模型对生成的视频进行自动回归增强,以提高质量和分辨率。

      目前,StreamingT2V已经在GitHub上开源,并在huggingface上提供了免费试玩。尽管服务器负载可能较高,但用户可以尝试输入文字和图片提示来生成视频。此外,huggingface上也展示了一些成功的案例,证明了StreamingT2V在视频生成方面的强大能力。

      StreamingT2V的发布不仅为视频生成领域带来了新的技术突破,也为开源社区提供了一个强大的工具,有助于推动相关技术的发展和应用。未来,我们或许可以期待更多基于这类技术的创新应用,例如在电影制作、游戏开发、虚拟世界构建等领域发挥重要作用。

      文章内容仅供阅读,不构成投资建议,请谨慎对待。投资者据此操作,风险自担。

    即时

    新闻

    明火炊具市场:三季度健康属性贯穿全类目

    奥维云网(AVC)推总数据显示,2024年1-9月明火炊具线上零售额94.2亿元,同比增加3.1%,其中抖音渠道表现优异,同比有14%的涨幅,传统电商略有下滑,同比降低2.3%。

    企业IT

    重庆创新公积金应用,“区块链+政务服务”显成效

    “以前都要去窗口办,一套流程下来都要半个月了,现在方便多了!”打开“重庆公积金”微信小程序,按照提示流程提交相关材料,仅几秒钟,重庆市民曾某的账户就打进了21600元。

    3C消费

    华硕ProArt创艺27 Pro PA279CRV显示器,高能实力,创

    华硕ProArt创艺27 Pro PA279CRV显示器,凭借其优秀的性能配置和精准的色彩呈现能力,为您的创作工作带来实质性的帮助,双十一期间低至2799元,性价比很高,简直是创作者们的首选。