最近用Hy3把我那套短视频工作流从v1重做到了v2。前后调了挺久,有些真实感受想记一下——不聊参数,不跑分,就聊实际用下来怎么样。
先说做了什么。这套工作流是用Remotion程序化生成竖版短视频的。v1太像PPT,v2加了素材层、镜头推拉、交叉溶解。中间渲染环节踩了一串坑,前前后后五六轮才稳。也就是说,我和Hy3一起,是从零把这套东西搭出来,还把一堆工程坑填平的。
客观说,Hy3在几个方面都"还行",没有明显短板。
速度还行。对话跟得上思路,不会出现"等半天出不来"的情况,改代码也快,小步迭代不卡。
推理还行。每次报错,它能比较准地分析出根因,不是瞎猜。比如渲染卡在某一帧,它能从日志判断是死锁而不是普通报错,方向基本对。这点很关键,因为乱猜的话,我会在错误方向耗更久。
处理问题还行。每个崩溃它都能给出修法,而且改了基本能跑,不用推倒重来。
准确性还行。生成的代码、改的配置,落到地上能用。对"边做边调"的工作流来说,这点顶重要——要是每次改完都跑不起来,那还不如我自己写。
不过"还行"不等于"放心"。我后面说的那个问题,恰恰就藏在"还行"上面:它能把每一个坑填上,但不知道坑一共有几个。
==但有个让我折腾最久的问题:它不能一次解决多个问题,也不能提前看见技术方案里的潜在坑==。
这次调渲染最典型。它是"崩一个、修一个"的节奏:feTurbulence崩了→改;改完x264内存炸了→再改;改完解码越界→再改;改完transform死锁→再改……每一轮它都只解决"眼前这一个",不会说"你这个方案里还有三个雷,我先一起排了"。最烦的不是崩,是每次改完你觉得"这下总该好了吧",跑一半又卡在另一个地方。那种期待落空的感觉,比一直崩还累。
更麻烦的是,它没能提前预见这些坑。比如"OffthreadVideo被镜头transform包裹会触发软件渲染死锁""音频采样率不一致会导致混音崩溃",这些在动手写代码之前,一个有经验的工程师其实能预判。但Hy3是写完跑崩了才告诉你——而那一轮一轮的崩,==前后耗了我差不多一整天==。
说白了,它很会解决问题,但替你做架构评审这件事,它干不了。
我现在用它的方式很明确:==小步快跑==。把大任务拆碎,每一步让它解决一个小问题;架构层面的潜在风险,还是自己把关,或者在动手前多问它一句"这个方案有没有我没想到的坑"。比如这次我就该在写之前问它"OffthreadVideo在镜头里会不会有渲染问题",而不是等崩了再问。下次我会记得先问。它不是不能干大事,是需要你当那个"看出整体风险"的人。
整体评价就一句:能干活、改得对、跟得上,是靠谱的AI编程搭子。短板也清楚——别指望它一次把坑全填了,也别指望它替你预见所有技术雷。认清这两点,配合起来效率很高。