长文本处理需求 - 百万字小说

嗯,我尝试提一下需求吧,告诉一下各位有这个需求,以及理由,并尝试探讨如何解决。

我发现思源其实按理来说比较适合看书,但是,一直没啥机会用,最近尝试导入 txt 文本看书,然后就发现需求了。

  1. 首先就是章节,我不太可能一个个去设置为一级标题,这样看目录就不太方便。
  2. 其次,有点卡(当然只是导入,以及大幅度翻页的时候会容易卡,但还可以接受。)
  3. 双页阅读,我这人比较喜欢双页,这样更适合大屏,以及眼睛活动,还能减少操作幅度。(不过这样可能就不太适合上下滚动翻页,就比较需要翻页。)
  4. 其实按理说,如果我在各类正版网站看是没问题的,我也经常看,花了不少钱,但是我总觉得,那些书,我看了,仍然不是我的,书籍以本地形式存储更有一种安心的感觉,类似放在家里书房,闲着没事就来看看。
  5. 书页宽度,我知道能改,但难道每次看书我都要改,不看又要改回来吗,这也是我说要双页阅读的原因,这样不管怎么样起码不会看着看着丢行。
  6. 其实按理来说,如果接入开源阅读会是个比较好的选择,可惜那个无 pc 版,而且如果以浏览器访问,效果不太好。
  • 思源笔记

    思源笔记是一款隐私优先的个人知识管理系统,支持完全离线使用,同时也支持端到端加密同步。

    融合块、大纲和双向链接,重构你的思维。

    18822 引用 • 70441 回帖

相关帖子

欢迎来到这里!

我们正在构建一个小众社区,大家在这里相互信任,以平等 • 自由 • 奔放的价值观进行分享交流。最终,希望大家能够找到与自己志同道合的伙伴,共同成长。

注册 关于
请输入回帖内容 ...
  • 你这些需求不太建议用思源实现,还是看看有没有其他替代品吧

    1 回复
  • 纯 txt 的直接用专门的 APP 看就行了,阅读啥的。如果要导入思源看,就要先在外面预处理一下,这种也很多教程,批量替换啥的,加上标题、分开章节甚至分开文档。

    1 回复
  • 5Z4Uo6oGvKPB7o 2 赞同

    你的需求内容是一款阅读器的功能。思源是笔记软件,可能不太适合。

    可以考虑 txt 导入微信读书,移动端 + 网页端阅读体验都挺好的,而且可以自动同步阅读进度(这一点思源笔记也做不到)。读完后结合思源笔记集市的【微信读书】插件,可以同步划线笔记等内容。

    1 回复
  • 😄 我之前想这样看,结果发现太弱了。后来还是在 word 里面看

    替换格式把带章节的替换成标题格式、也支持双页

    1 回复
  • 我曾经处理过,用替换功能,将章节名替换为 思源的标题,这样思源的大纲就是书的目录了,然后导出 epub…剩下的就是阅读器的事了。

    1 回复
  • 各个地方下载的 txt 都不太一样,如何识别标题都不一定。我都是看情况改改自己之前的 py 脚本。做成 md,然后决定导入 sy 或者制作为 epub。

    1 回复
  • abbj 1 赞同

    我在 chatgpt 的帮助下写了一个类似的脚本

  • yunlunnnn

    是的,我现在就是使用微信读书,以及起点,其实问题也在这,微信读书不存在 pc 端,网页端也存在使用不太方便的问题(比如只能设置字体大小,起点也是类似,导致我只想在手机看,大屏单页阅读实在过于难受),能用,但不好用的那种,我也尝试过模拟器,但是实在是模拟器启动过慢,并且很臃肿。

    1 回复
  • yunlunnnn

    我用过开源阅读,貌似标题方面每本书都存在不同,所以就存在问题,pc 端有些阅读器貌似识别的很好,但是总有某方面不太尽人意,比如同步等

  • yunlunnnn

    这似乎也是个好方法,但是如果看的时候突然想到什么,应该就会比较难处理,可能就会存在哪一天没打开思源,只能随便找个地方记,然后后期还需要转移笔记的情况,或者需要提前在思源创建该书籍的文档,但是这样可能会在某次忘记创建,然后就想到一些灵感,然后因为创建文档空隙,然后不小心忘记灵感

    1 回复
  • yunlunnnn

    所以只是尝试询问,不太好解决的话其实也不太影响,只是我觉得这是一个可能的思路。

  • yunlunnnn

    是的,的确是,主要是没太找到比较好的 pc 端阅读器,有些比较小众的,pc 和 pe 方面的同步存在一定问题,所以也在找

  • yunlunnnn

    主要是现在网页端的阅读网站都总有一种 pc 与狗不得入内的感觉,不好用。

  • 用微信读书即可

  • 可以试试油猴脚本 微信读书 (greasyfork.org)

    image.png

    1 回复
  • 我是这样使用的,思源作为一个笔记整理结果的汇集地,其他零散的记录在别的地方,比如浏览器剪藏、备忘录、word、pdf 等等。

    这种长文本的我个人习惯是在 word 中处理,可以加背景、调顺序、变颜色、写批注(这个批注用来记疑惑、灵感等),整个常文本都读完之后再根据标记的这些内容读一遍,然后没啥问题了往思源整理,这个时候疑惑、灵感都有了回答

    1 回复
  • calibre + koreader. 这套组合的唯一缺点是没有覆盖 ios

    1 回复
  • yunlunnnn

    好的,感谢

  • yunlunnnn 1 赞同

    主要是觉得分散在各个软件处理太多麻烦,不太喜欢做太多无意义的事,并且很多时候会存在很大局限性,所以宁愿接受一点功能降级,也想尝试一站式解决问题,现在看来确实要求有些高了,不过我觉得未来会有的。

    1 回复
  • yunlunnnn

    好的,我会尝试一下的。

  • 看到思源集市这个插件预览图,好像可以实现双页浏览,可以试试。

    关于 txt 内容章节设置标题,我的方法是在 sublime 中使用正则表达式批量替换的。比如有的书籍是“第一章”“第一节”,那就替换成“# 第一章”“## 第一节”,另存为 md 格式,导入思源笔记就可以。

    image.png

    这是以前替换标题时常用的几组正则表达式

    image.png

  • 一站式很难,而且即便出来了一站式的软件 成本上 普通用户也接受不了,属于富人不愿意买 穷人买不起的情况。这样还不如自己开发

  • sky2023

    看书建议用看书软件

请输入回帖内容 ...

推荐标签 标签

  • Typecho

    Typecho 是一款博客程序,它在 GPLv2 许可证下发行,基于 PHP 构建,可以运行在各种平台上,支持多种数据库(MySQL、PostgreSQL、SQLite)。

    12 引用 • 60 回帖 • 461 关注
  • Node.js

    Node.js 是一个基于 Chrome JavaScript 运行时建立的平台, 用于方便地搭建响应速度快、易于扩展的网络应用。Node.js 使用事件驱动, 非阻塞 I/O 模型而得以轻量和高效。

    138 引用 • 268 回帖 • 192 关注
  • IPFS

    IPFS(InterPlanetary File System,星际文件系统)是永久的、去中心化保存和共享文件的方法,这是一种内容可寻址、版本化、点对点超媒体的分布式协议。请浏览 IPFS 入门笔记了解更多细节。

    20 引用 • 245 回帖 • 230 关注
  • Flume

    Flume 是一套分布式的、可靠的,可用于有效地收集、聚合和搬运大量日志数据的服务架构。

    9 引用 • 6 回帖 • 596 关注
  • C

    C 语言是一门通用计算机编程语言,应用广泛。C 语言的设计目标是提供一种能以简易的方式编译、处理低级存储器、产生少量的机器码以及不需要任何运行环境支持便能运行的编程语言。

    83 引用 • 165 回帖 • 40 关注
  • 开源

    Open Source, Open Mind, Open Sight, Open Future!

    397 引用 • 3416 回帖
  • NetBeans

    NetBeans 是一个始于 1997 年的 Xelfi 计划,本身是捷克布拉格查理大学的数学及物理学院的学生计划。此计划延伸而成立了一家公司进而发展这个商用版本的 NetBeans IDE,直到 1999 年 Sun 买下此公司。Sun 于次年(2000 年)六月将 NetBeans IDE 开源,直到现在 NetBeans 的社群依然持续增长。

    78 引用 • 102 回帖 • 641 关注
  • Mobi.css

    Mobi.css is a lightweight, flexible CSS framework that focus on mobile.

    1 引用 • 6 回帖 • 698 关注
  • 自由行
    2 关注
  • 持续集成

    持续集成(Continuous Integration)是一种软件开发实践,即团队开发成员经常集成他们的工作,通过每个成员每天至少集成一次,也就意味着每天可能会发生多次集成。每次集成都通过自动化的构建(包括编译,发布,自动化测试)来验证,从而尽早地发现集成错误。

    14 引用 • 7 回帖 • 3 关注
  • 开源中国

    开源中国是目前中国最大的开源技术社区。传播开源的理念,推广开源项目,为 IT 开发者提供了一个发现、使用、并交流开源技术的平台。目前开源中国社区已收录超过两万款开源软件。

    7 引用 • 86 回帖
  • FFmpeg

    FFmpeg 是一套可以用来记录、转换数字音频、视频,并能将其转化为流的开源计算机程序。

    22 引用 • 31 回帖 • 3 关注
  • Hprose

    Hprose 是一款先进的轻量级、跨语言、跨平台、无侵入式、高性能动态远程对象调用引擎库。它不仅简单易用,而且功能强大。你无需专门学习,只需看上几眼,就能用它轻松构建分布式应用系统。

    9 引用 • 17 回帖 • 596 关注
  • FlowUs

    FlowUs.息流 个人及团队的新一代生产力工具。

    让复杂的信息管理更轻松、自由、充满创意。

    1 引用
  • 旅游

    希望你我能在旅途中找到人生的下一站。

    85 引用 • 895 回帖
  • JWT

    JWT(JSON Web Token)是一种用于双方之间传递信息的简洁的、安全的表述性声明规范。JWT 作为一个开放的标准(RFC 7519),定义了一种简洁的,自包含的方法用于通信双方之间以 JSON 的形式安全的传递信息。

    20 引用 • 15 回帖 • 18 关注
  • Chrome

    Chrome 又称 Google 浏览器,是一个由谷歌公司开发的网页浏览器。该浏览器是基于其他开源软件所编写,包括 WebKit,目标是提升稳定性、速度和安全性,并创造出简单且有效率的使用者界面。

    60 引用 • 287 回帖 • 2 关注
  • App

    App(应用程序,Application 的缩写)一般指手机软件。

    90 引用 • 383 回帖
  • MongoDB

    MongoDB(来自于英文单词“Humongous”,中文含义为“庞大”)是一个基于分布式文件存储的数据库,由 C++ 语言编写。旨在为应用提供可扩展的高性能数据存储解决方案。MongoDB 是一个介于关系数据库和非关系数据库之间的产品,是非关系数据库当中功能最丰富,最像关系数据库的。它支持的数据结构非常松散,是类似 JSON 的 BSON 格式,因此可以存储比较复杂的数据类型。

    90 引用 • 59 回帖 • 1 关注
  • Vim

    Vim 是类 UNIX 系统文本编辑器 Vi 的加强版本,加入了更多特性来帮助编辑源代码。Vim 的部分增强功能包括文件比较(vimdiff)、语法高亮、全面的帮助系统、本地脚本(Vimscript)和便于选择的可视化模式。

    27 引用 • 66 回帖 • 1 关注
  • ZeroNet

    ZeroNet 是一个基于比特币加密技术和 BT 网络技术的去中心化的、开放开源的网络和交流系统。

    1 引用 • 21 回帖 • 593 关注
  • iOS

    iOS 是由苹果公司开发的移动操作系统,最早于 2007 年 1 月 9 日的 Macworld 大会上公布这个系统,最初是设计给 iPhone 使用的,后来陆续套用到 iPod touch、iPad 以及 Apple TV 等产品上。iOS 与苹果的 Mac OS X 操作系统一样,属于类 Unix 的商业操作系统。

    84 引用 • 139 回帖 • 2 关注
  • 知乎

    知乎是网络问答社区,连接各行各业的用户。用户分享着彼此的知识、经验和见解,为中文互联网源源不断地提供多种多样的信息。

    10 引用 • 66 回帖 • 1 关注
  • JVM

    JVM(Java Virtual Machine)Java 虚拟机是一个微型操作系统,有自己的硬件构架体系,还有相应的指令系统。能够识别 Java 独特的 .class 文件(字节码),能够将这些文件中的信息读取出来,使得 Java 程序只需要生成 Java 虚拟机上的字节码后就能在不同操作系统平台上进行运行。

    180 引用 • 120 回帖
  • Q&A

    提问之前请先看《提问的智慧》,好的问题比好的答案更有价值。

    6591 引用 • 29589 回帖 • 251 关注
  • 微软

    微软是一家美国跨国科技公司,也是世界 PC 软件开发的先导,由比尔·盖茨与保罗·艾伦创办于 1975 年,公司总部设立在华盛顿州的雷德蒙德(Redmond,邻近西雅图)。以研发、制造、授权和提供广泛的电脑软件服务业务为主。

    8 引用 • 44 回帖
  • Sillot

    Sillot (汐洛)孵化自思源笔记,致力于服务智慧新彖乄,具有彖乄驱动、极致优雅、开发者友好的特点
    Github 地址:https://github.com/Hi-Windom/Sillot

    18 引用 • 6 回帖 • 28 关注