点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:火山引擎发布大模型训练视频预处理方案
首页> 科技频道> 人工智能 > 正文

火山引擎发布大模型训练视频预处理方案

来源:光明网2024-10-15 14:05

  10月15日,火山引擎在视频云技术大会上发布了大模型训练视频预处理方案,助力解决视频大模型训练的成本、质量和性能等方面的技术挑战。目前,该技术方案已应用于豆包视频生成模型。

  火山引擎总裁谭待表示,在AIGC、多模态等技术的共同推动下,用户体验在多个维度上经历着深刻转变,“基于抖音业务实践和与行业客户共创,火山引擎视频云正积极探索AI大模型与视频技术的深度融合,在技术底座、处理链路和业务增长层面为企业寻找解法。”

  自研多媒体处理框架BMF ,助力豆包视频生成模型突破业界难题

  据介绍,对训练视频进行预处理是保障大模型训练效果的重要前提。预处理过程可以统一视频的数据格式、提高数据质量、实现数据标准化、减少数据量以及处理标注信息,从而使模型能更高效地学习视频中的特征和知识,提升训练效果和效率。

  抖音集团视频架构负责人王悦表示,对大模型厂商而言,上述过程中面临着诸多挑战。

  “首先,超大规模视频训练数据集导致计算和处理成本激增,”王悦说,“其次是视频样本数据参差不齐,然后是处理链路环节多、工程复杂,最后还面临着对GPU、CPU、ARM等多种异构算力资源的调度部署。”

  借助Intel的CPU、GPU等不同资源,火山引擎此次发布的大模型训练视频预处理方案依托于自研的多媒体处理框架BMF,能有效应对模型训练的算力成本挑战。

  此外,该方案还在算法和工程方面进行了调优,可以对海量视频数据高质量预处理,短时间内实现处理链路的高效协同,提高模型训练效率。值得一提的是,火山引擎本次还发布并开源了移动端后处理解决方案BMF lite版本。BMF lite支持端侧大模型接入和算子加速,更加轻量、通用。

  Bytedance Research 负责人李航介绍,豆包视频生成模型PixelDance在训练过程中采用了火山引擎的大模型训练视频预处理方案,充分利用了大量潮汐资源,为模型训练提供了有力支撑。火山引擎视频云团队提供的点播解决方案还为PixelDance生产的视频提供了从编辑、上传、转码、分发、播放的全生命周期一站式服务,让模型的商业化应用有了保障。

  据了解,豆包视频生成模型PixelDance于9月24日发布,该模型采用 DiT 架构,通过高效的DiT融合计算单元和全新设计的扩散模型训练方法,突破了多主体运动的复杂交互、多镜头切换的内容一致性难题,在业界引起广泛关注。目前,豆包视频生成模型已通过火山引擎面向企业开启邀测。

  多项“音视频+AI”技术方案,助力企业全链路适配AIGC时代

  此次活动中,火山引擎还发布了跨语言同声复刻直播方案、多模态视频理解与生成方案、对话式AI实时交互方案和AIG3D&大场景重建方案,从视频的生产端、交互端到消费端,全链路融入了AI的能力。

  火山引擎视频云负责人表示,在AI视频时代,人和AI交互变得更加动态和生动,这要求处理链路更加智能和交互。

  以对话式AI实时交互方案为例,依托豆包大模型和火山引擎视频云自研的多项算法,火山引擎为用户提供了智能对话和自然语言处理的强大能力,可实现毫秒级人声检测和打断响应,以及丝滑稳定的端到端响应体验。

  在沉浸式消费体验方面,火山引擎通过AI生成3D内容和大场景重建方案,为山西高平二郎庙金代戏台和北京正乙祠两座珍贵的历史建筑生成了3D数字资产,并以虚拟直播间的形式应用于抖音的戏曲直播场景。

  大会上,王悦还透露了字节自研视频编解码芯片的最新进展,经过抖音集团内部的实践验证,该芯片在同等视频压缩效率下,成本节省了95%以上,还在2024MSU世界编码器大赛中一举夺得最佳ASIC编码器。

  据悉,该芯片将于近期正式对外开放测试,招募首批种子用户,共同探索商业价值的可复制性。(科文)

[ 责编:李欣哲 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 我国全超导用户磁体取得重大突破

  • 瞄深空!南极“天眼”看见了啥?

独家策划

推荐阅读
水稻耐不耐旱,和叶子的厚实程度相关,这是由什么因素决定的?日前,中国农业科学院作物科学研究所水稻分子设计技术与应用创新团队发现,水稻基因组中的三个耐旱基因可以“团队作战”,
2026-01-27 02:50
年轻人享受便利的同时,关注新的变化:智能穿戴设备是否正在塑造一个充满数据和规定的生活方式?“贴身伙伴”的出现改变了生活,人们同自己身体、同生活本身的关系,是不是也在变?
2026-01-27 03:15
商业航天是培育新质生产力、建设航天强国的重要力量。面对全球商业航天竞争日趋激烈的态势,中国商业航天亟须推动产业从“政策驱动”转向“市场驱动”。
2026-01-27 09:18
云南大学研究团队日前在国际学术期刊《自然》发表了关于早期脊椎动物视觉系统演化的研究成果,首次揭示了早期脊椎动物具有4只相机型眼,
2026-01-27 02:50
印度东部西孟加拉邦近期出现尼帕病毒感染病例,目前已报告5例确诊病例,其中一名患者病情危重。泰国、尼泊尔等国已在机场和边境口岸加强防疫检测。尼帕病毒是一种新出现病毒吗?它有哪些特点?为何印度暴发的尼帕病毒疫情引起多国高度关注?
2026-01-27 03:15
科学家精神在我国科技发展事业中萌芽、生成、丰富、完善,成为兼具历史传承性、文化包容性与民族独特性的精神标识,不仅教育引导各类人才矢志爱国奋斗、锐意开拓创新,更是拔尖创新人才成长的精神旗帜与动力源泉。
2026-01-27 03:15
1月26日,将迎来腊八。一些细心的公众发现,相较于前些年,今年腊八来得有些晚。
2026-01-26 09:59
据农业农村部最新发布的数据,2025年全国粮食产量达到14298亿斤,增产168亿斤,连续两年稳定在1.4万亿斤以上。
2026-01-26 09:56
试验将收集锋面不同高度、不同位置的气象数据,为深化云贵准静止锋研究、提升预报服务能力提供更全面的支撑。
2026-01-26 09:51
中国科学家在国际学术期刊《细胞》发表论文,首次系统揭示了埃博拉病毒在2018—2020年大规模流行期间的一个关键“优势”突变。
2026-01-26 09:49
这一问题在当代科技哲学与美学的交叉前沿领域日益成为争论的焦点。
2026-01-26 09:48
我国结核病防治虽成效显著,疫情持续下降,但当前形势依然严峻,防治工作任重道远。作为一名从业30多年的结核科医生,我一直专注于结核病的临床诊治与防控,从未想过自己会与结核病防治历史结缘——直到十余年前。
2026-01-23 10:13
每到冬天,许多人都会感到手脚冰凉,即使穿得很厚,也难以真正暖和起来。为什么会有这种现象?该如何有效改善?
2026-01-23 10:06
“设立教育基金是我多年的心愿,希望为学校年轻人的培养作一点贡献。”
2026-01-23 10:01
1月22日,中科宇航将微重力金属增材制造返回式科学实验载荷交付于中国科学院力学研究所。这台由力学所自主研制的载荷,搭载于中科宇航力鸿一号遥一飞行器,于1月12日成功开展我国首次太空金属增材制造(即“3D打印”)实验。据悉,这是我国首次基于火箭平台实施太空金属增材制造返回式科学实验。
2026-01-23 09:48
团队所制备的“纤维芯片”中,电子元件(如晶体管)集成密度达10万个/厘米,通过晶体管高效互连,可实现数字、模拟电路运算等功能。而在虚拟现实领域,基于“纤维芯片”所构建的智能触觉手套适用于远程手术组织硬度感知、虚拟道具交互等场景,有望极大提升用户与虚拟环境的交互体验。
2026-01-23 09:48
扎实推进科普智库各项建设工作,为实现2035年“终结结核病流行”目标注入强劲的思想动力与坚实的行动支撑。
2026-01-22 18:44
国家能源局21日发布的数据显示,截至2025年12月底,我国电动汽车充电设施数量达2009.2万个,突破2000万大关。方案提出,到2027年底,将在全国范围内建成2800万个充电设施,提供超3亿千瓦的公共充电容量,满足超过8000万辆电动汽车充电需求,实现充电服务能力的翻倍增长。
2026-01-22 09:31
正因如此,团队创新性转向了模拟计算这一新兴赛道,成功研制出基于阻变存储器的非负矩阵分解模拟计算求解器。“这项工作为非负矩阵分解这类约束优化问题的实时求解开辟了新路径,展现了模拟计算处理现实复杂数据的巨大潜力。
2026-01-22 09:28
对于成千上万的心脏病患者来说,植入心脏起搏器是维持生命节律的重要方式。该起搏器设计极度微型化,生物相容性优异,可通过微创导管经股静脉植入心脏内部,大大降低了手术创伤。
2026-01-22 09:27
加载更多