业内首创,豆包VideoWorld开源,仅通过纯视觉信息认知世界
2月10日,界面新闻获悉,豆包大模型团队联合北京交通大学、中国科学技术大学共同开发的视频生成实验模型“VideoWorld”正式开源。不同于主流多模态模型,VideoWorld 在业界首次实现无需依赖语言模型,即可认知世界。这一创新,也是在人工智能视频生成和多模态认知方面取得的重要突破。传统的多模态模型,如Sora、DALL-E和Midjourney等,大多依赖于语言或标签数据来学习知识,而Vid