向我的25位用户问好,虽然是个小更新,但一个烦人的漏洞终于被修复了。

更新内容

如果你使用改写模式(编辑器中可以真正修改文字内容的部分,而不仅仅是修改说话人),现在你可以像正常人一样撤销和重做了。工具栏里有按钮,也可以使用 Ctrl+Z 和 Ctrl+Y(或者如果你习惯的话,用 Ctrl+Shift+Z)。

实际上费了些功夫才做对的部分:

  • 在你打字或退格时,这些操作会合并成一步撤销步骤,就像任何文本编辑器一样。但如果你选中一段文字并删除,或者用 Ctrl+A+Delete,或者粘贴一段文本,那始终会是一个独立的步骤,不会和你之前或之后输入的内容粘在一起。Ctrl+Z 会精确撤销你刚刚做的那一步操作,不会多撤销。
  • 撤销历史最多保留 50 步,当你离开改写模式、切换章节、放弃修改或保存时,历史记录会清空,所以不会一直占用内存。
  • 在发布之前发现并修复了两个 bug:一个是在撤销后,段落框有时不会重新调整大小,尽管下方的文本已经正确了,看起来像是坏了,直到你点击其他地方才恢复正常。另一个是,在输入后立即进行选择删除操作,可能会悄悄合并到输入步骤中,而不是作为一个独立步骤。现在这两个问题都已修复。

另外,将撤销/重做按钮从小图标替换成了文字按钮,并调整了间距。

下载地址:https://lunosama.itch.io/narrationos


如果你完全不知道这是什么

NarrationOS 利用 AI 将书籍转化为有声书,并且完全运行在你自己的电脑上。没有 token 限制,意味着可以无限生成,无需云服务,无需账号,无需订阅,完全离线运行在你的个人电脑上。

我之所以做这个,是因为我想要一本当时还不存在的有声书,而且厌倦了等待,所以我干脆自己建了一个。这是一个个人项目,有些地方还很粗糙,但质量很好,而且非常实用,主要是为我自己设计的。

它的功能:

  • 几乎可以处理任何书籍文件。 支持 EPUB、PDF、DOCX、RTF、TXT、Markdown、HTML、链接,或者直接粘贴文本。甚至扫描版的 PDF 也能处理,它会先进行 OCR 识别。
  • 用 AI 语音朗读,并且你可以在后台渲染书的其余部分时,开始收听已完成章节的内容。
  • 逐词高亮,跟随朗读进度,如果你想跟着看的话。
  • 你真的可以修改错误。 点击某一行可以修正读错的名称,更改说话人,添加音效等等,在提交完整渲染之前可以预览效果。如果原文有错误,你还可以直接重写实际文本(这正是整篇帖子所讲的内容)。
  • 克隆声音,但会先要求你确认是否已获得授权。不想让用户克隆他们没有权限使用的声音。
  • 导出 为音频文件或 MP4 文件,播放时屏幕上的文字会高亮显示。
  • 有一个实验性的多角色语音模式,会尝试自动检测谁在说话,并为每个角色分配不同的声音。不过说实话,这个功能还比较粗糙,需要大量手动修正,所以我不想假装它已经准备好。目前单叙述者模式是更为可靠的选择。

关于“完全离线”:AI 模型在你自己的硬件上本地运行,没有任何内容会被上传到任何地方。第一次启动时,它需要自行设置,根据你的 GPU 情况,可能需要一次性下载几个 GB 的数据。之后无需网络即可运行。你的书籍和任何语音样本都保留在你的电脑上。

支持 NVIDIA 或 AMD 显卡以获得更快的渲染速度,或者如果你没有支持的显卡,也可以使用 CPU(但速度会比实时慢)。Intel Arc 在技术上是可行的,但仍处于实验阶段。

https://lunosama.itch.io/narrationos