logologo
寻找工作
返回简章2026-07-26 更新

视频转译文本(影视caption)

西安
本科及以上
不限专业
使用简历深度优化功能,快速提升简历质量
职位介绍
工作时间:9:30-18:00周末双休。 工作内容: 日常工作是将视频画面转化为标准文本。具体来说,你要观看视频,然后用准确、清晰、不带主观想象的文字,把画面里发生了什么(比如谁在哪儿、做了什么动作、镜头怎么移动、光线氛围如何等)写成一段文字描述。 职位描述: 1、本岗位直接服务于视频生成(Text-to-Video)与大模型视频自然语言理解模型的训练。 2、核心工作是对海量视频素材进行视觉拆解、镜头逻辑分析与高精度描述撰写,对视频内容进行高精度文本化转译,撰写语法严谨、语义无歧义、逻辑连贯的视频Caption,建立并维护标注规范体系。 3、您将作为“视觉翻译官”,把动态画面转化为机器可学习、人类可理解的文本数据,直接决定模型对空间关系、动作轨迹、光影氛围与叙事节奏的还原能力,确保文本数据在句式结构、词汇选择、时空逻辑上高度一致,直接提升模型对复杂指令的理解力与生成文本的准确性。 任职要求: 1、 本科及以上学历,影视或语言类相关专业(广播电视编导、电影学、戏剧影视文学、数字媒体艺术、动画、汉语言文学、语言学及应用语言学、计算语言学、对外汉语等) 2、扎实的视听语言基础,能精准识别并描述画面主体、动作序列、空间布局、光影变化及镜头运动(推拉摇移、景别切换、运镜逻辑等);深厚的语言文字功底,精通现代汉语语法体系,对词汇语义、句法结构、语用场景有敏锐辨析力。 3、优秀的文字转译能力与严密的逻辑思维能力,能将复杂动态场景转化为客观、准确、无主观臆断的结构化文本,准确处理复杂动作序列、多人物交互及抽象概念的文本转译,有效消除指代不明、因果倒置或逻辑断层; 4、具备基础的视频审阅/剪辑经验,熟悉时间轴操作,能高效进行关键帧定位、片段拆分与节奏打点。