来源 | Tech星球
文 | 张宁洢
字节跳动旗下的AI视频生成产品即梦AI,在业内一直保持领先地位。成功的关键不仅在于大模型的持续优化,还在于字节自身强大的分发渠道。自从接入豆包和CapCut后,即梦AI的流量便一直稳居行业前茅。Seedance2.0版本上线后,更是在流量增长上达到了新的高度。
就在即梦AI占据市场主导地位的背景下,两款由字节前高管创办的新产品正吸引着广泛关注。
2025年6月推出的“拍我AI”来自爱诗科技,其创始人兼CEO王长虎曾任字节跳动AI Lab视觉负责人,曾从零开始搭建抖音和TikTok的视觉技术体系。爱诗科技在2026年7月宣布完成整体C轮融资,总额达29.8亿元。阿里巴巴等多家机构参与了投资,此外还有鼎晖投资、中国儒意、三七互娱等资本入局。
2026年3月问世的LiblibTV则源于演语科技,其创始人陈冕曾是字节跳动剪映与CapCut的全球商业化负责人,也是字节内部最年轻的高级管理人员。演语科技在2026年6月正式宣布完成近3亿美元的B+轮融资,估值超过20亿美元,这一数字刷新了国内AI应用赛道的融资纪录。本轮融资由GraniteAsia、腾讯、顺为资本联合领投,HTInvestment、时代资本跟投,高榕、蚂蚁等老股东也参与了追投。
两款产品面世不久便备受瞩目,市场普遍期待它们能否超越老东家。当字节遭遇自家前高管创办的新势力,这两位“出走”的弟子能否撼动“老师傅”的地位?
自研大模型与Seedance的较量
拍我AI和LiblibTV虽然同属于AI视频生成产品,但它们的发展路径却大相径庭。LiblibTV更像是一个聚合平台,继续采用字节的大模型Seedance,以及快手的可灵(Kling),通过灵活的工作流设计和多样化的skill组合来完成视频制作;而拍我AI则坚持使用自研模型Pixverse,尽管近期也接入了Seedance 2.0,但其研发重心依然在于模型技术。
归根结底,在基础技术层面,这两款产品代表了Seedance与新晋大模型的直接对决。
Tech星球对两款产品进行了实际测试。LibTV使用了其自带的Seedance 2.0模型,而拍我AI则采用了爱诗科技自研的Pixverse V6模型。通过让两款产品生成相同视频的方式,测试它们对提示词的理解程度和画面质量。
首先,分别向两个产品下达指令,要求生成一个动漫风格的马斯克在美加墨世界杯观看比赛的视频。
拍我AI生成的第一版视频中,人物形象过于瘦削,尤其是下巴线条十分突出,与马斯克的本人形象存在较大差异。背景部分则完全看不出是在世界杯现场,更像是一个电竞场馆。
针对这一问题,再次发出指令,要求将场景改为更具世界杯氛围的赛场,同时加入进球场景的元素。这次场景部分确实改进了,但人物位置出现混乱,在进球时突然切换位置,直接将人物移动到了足球场上,人物的反应也显得有些迟缓,与剧情发展不太协调。
随后,将两次指令合并重新生成视频,场景和动线基本符合要求,但人物面部特征已经严重偏离提示词,衣服也变成了夹克。这既不符合人物的日常着装,也与赛场环境不搭,同时依然存在人物位置切换的问题,稳定性欠佳。
相比之下,LibTV生成的视频中,人物形象更加精准,与马斯克的外貌特征高度吻合,身穿球衣,场景氛围相符,人物表情变化也符合情节。不过,人物表情略显夸张,手中的旗子和手套有些突兀,镜头运用也相对单一。
进一步发出指令,要求加入进球场景。LibTV的表现依旧符合逻辑。
再让两款产品分别生成一个机器人在舞台上跳芭蕾舞的视频。拍我AI在场景体现上依然不够准确,没有明确展现舞台元素;而LibTV则完整地展现了舞台细节。
从实际体验来看,Pixverse V6在画面和细节设计上表现丰富,但对于零技术背景的用户来说,容易忽略提示词中的关键信息,偶尔还会生成一些不合逻辑的内容,需要不断调整描述才能达到预期效果。








