来客网

角色离场再回来,AI就换了个人?

声明:本文转载自 「Popyard」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]
01

你以为,AI只要能连续生成一分钟视频,就算解决了「长视频」?

真正的考验,往往发生在主角离开镜头之后。

第一幕,一个穿特定服装的人出现在实验室;第二幕,他离开画面;第三幕再次返回时,模型可能已经给他换了脸、换了衣服,甚至把原本应该回来的物体也一起「忘」了。

原因并不神秘。自回归视频模型通常一段一段生成画面,并用Key-Value(KV)缓存保存上下文。为了把计算量控制住,缓存往往优先保留最近片段。短期动作是连上了,但更早的身份、属性和场景线索也可能被挤出去。

近日,浙江大学与香港大学团队提出LayerRecall:不把整段历史一股脑塞回模型,而是同时回答两个问题——现在该想起什么?这段记忆又该在哪些层里使用?

论文地址:https://arxiv.org/abs/2608.28460

项目主页:https://yixuan-ding-zju.github.io/LayerRecall_Web/

GitHub:https://github.com/Yixuan-Ding-ZJU/LayerRecall

模型权重:https://huggingface.co/Yixuan-Ding-ZJU/LayerRecall

0

评论 (0)