baocut
無料用 BaoCut 处理视频与音频:转录、字幕、翻译、配音、剪口播、切短视频、分章、总结写稿、从链接下载、压缩转码、导出成片,或从零做一条成片。有媒体文件、视频链接、字幕文件或 BaoCut 视频时用;只翻译纯文本、与视频无关的写作或作图、别的剪辑器与 FFmpeg 的用法、BaoCut 源码开发不用。
日本語の概要は準備中です。原文の説明を表示しています。
视频的转写要校对或润色时用:改错字与误听,统一术语与专名,补正标点与分句,写回同一份转写,词的时间不变。做译文或建字幕层之前先做这一步。默认不改语法、不删口癖、不精简;去掉口癖与停顿是剪辑,不在这里做。不用于润色与视频无关的文章或纯文本。
インストール方法を見るインストールする前に、エージェントに与えられる指示の中身を確認できます。
用户拿到的转写是机器听出来的:人名拼错、术语听岔、标点乱放、一长段话用逗号连到底。他要的是一份能放心往下用的底稿:字幕按它断行,译文按它分句,文稿按它导出。润色就是从头到尾顺读一遍的校订:把听错的改对,把标点补正,说话人原来怎么说就保留怎么说。
最容易做坏的样子有两种。一种是改多了:顺手把口语改成书面语,把口癖删掉,把啰嗦的句子精简,甚至把夹杂的外语译掉。这样文字好看了,但字幕和声音对不上,观众听到的和看到的不是一回事。另一种是把一句话的文本挪到别的词上,或者加了词、删了词:每个词都带着时间,词一错位,整段字幕的时间就全错了。
用 documents_read 读 kind 为 speech 的转写(有几份时按来源素材对上用户说的那段)。正文的 words 是一串词,每个词有 id、开始与结束时间、说话人和 text;标点贴在词的 text 上:句末标点在一句最后那个词的末尾,开引号、开括号在第一个词的开头。
写回时只改词的 text:
Chat GBT 改成 Chat GPT)。分摊不了(要删一个词或多出一个词才对得上)时不要硬改,在交付说明里列出这一处和正确写法。为什么这么严:字幕的每一条、译文的每一句都对着这些词的时间。你改的是字,时间轴不能动。
先通读全文,定下这几件事,全文照它们改。它们不进成品:
assets[].source(从链接导入的素材才有):标题、发布者(uploader)、简介(description)、作者的章节。它是背景参考,不是文稿内容,也不是绝对权威:里面人名、机构、产品、术语的准确写法是强校正提示,只在说话人明显在说它时才照它改;绝不因为简介里有就往文稿里加词、加事实。用户点名的写法仍是硬性要求,优先于它。because.、of.、当。、和。):把它接到后面的分句上,意思说完再断。。,、,。、,,、.,),只保留一个表达边界的。对比一下分句(只是示意):
不好:我们当时试了三种方案,第一种是直接上大模型,成本太高,第二种是蒸馏,效果掉得厉害,最后用的是第三种,就是混合的,
好:我们当时试了三种方案。第一种是直接上大模型,成本太高。第二种是蒸馏,效果掉得厉害。最后用的是第三种,就是混合的。
词一个没动,只改了标点;但前一种会被切成一条塞不下的字幕,后一种每句都能单独成条、单独翻译。
talking-head-cut)的做法,或用 edits_apply 的 proposeCuts 提出剪辑,剪时间线,不改转写。用户要求做这几件里的某一件时,先说清它会怎样影响字幕和译文,再做能做的那部分。
转写区分了说话人时,正文的 speakers[] 给每位说话人一个 id 和 name。自动区分只给占位名,润色写回之后,最后一件事是给占位名的说话人换上真名。名字会出现在每一条字幕和每个导出的文件里,所以这一步只认证据,不猜。
Speaker 1、Sprecher 1、Parlante 1 这类「说话人 + 编号」)、识别服务给的编号标签(SPEAKER_00、S1、spk-1),以及名字为空或等于 id 的(大小写不论)。别的名字都是用户或别人起的,不动。speakers[].name,words 与其他字段照读到的原样;几位一次写完。版本冲突时照第 6 节重新读。まだレビューはありません。使ってみた感想をお寄せください。
概要と使いどころ
用 BaoCut 处理视频与音频:转录、字幕、翻译、配音、剪口播、切短视频、分章、总结写稿、从链接下载、压缩转码、导出成片,或从零做一条成片。有媒体文件、视频链接、字幕文件或 BaoCut 视频时用;只翻译纯文本、与视频无关的写作或作图、别的剪辑器与 FFmpeg 的用法、BaoCut 源码开发不用。
日本語の概要は準備中です。原文の説明を表示しています。
测试用的说明书:用 BaoCut 转录、翻译、剪辑与导出视频。
日本語の概要は準備中です。原文の説明を表示しています。
Release BaoCut Electron desktop apps through GitHub Actions tags by default; use local/manual packaging only when explicitly requested. Also handles App version bumps, release continuation and portable signing backups; excludes craft skills and legacy standalone CLI releases.
日本語の概要は準備中です。原文の説明を表示しています。
用户要给视频做封面、要封面大字,或要标题和封面一起出时用:读文稿提炼卖点,给几组标题与封面文案,用户挑定后按视频画幅生成封面图,放进这个视频的候选素材。每句都由视频兑现。只要标题或简介、不要封面时用起标题与写简介。需要视频的转写。
日本語の概要は準備中です。原文の説明を表示しています。
要在视频上加一段动效图形时用:下横栏(姓名职务)、关键词字幕、大数字与图表、标注与引导、品牌贴片与片尾、倒计时与进度。不选模板,按规则写一个自包含的 HTML 画面(时间的纯函数),打包成代码包导入后放上时间线。只加静态文字、贴纸或已有的文字动画预设时不用;整条成片的规划看「从简报到成片」。
日本語の概要は準備中です。原文の説明を表示しています。
做一条由旁白带着走的成片(资讯快评、知识讲解、产品介绍、步骤教程),或给已有画面配一段多句的旁白时用:先按实测语速算出稿子该有多少字、按句分行写稿,再选一个全片不变的音色、用同一套语气说明一次合成,量时长、查接缝、只重配不合格的句子,最后把画面剪到旁白上。不用于把视频配成另一种语言(翻译配音),也不用于只念一句话。
日本語の概要は準備中です。原文の説明を表示しています。