长文本处理需求 - 百万字小说

本贴最后更新于 230 天前,其中的信息可能已经时异事殊

嗯,我尝试提一下需求吧,告诉一下各位有这个需求,以及理由,并尝试探讨如何解决。

我发现思源其实按理来说比较适合看书,但是,一直没啥机会用,最近尝试导入 txt 文本看书,然后就发现需求了。

  1. 首先就是章节,我不太可能一个个去设置为一级标题,这样看目录就不太方便。
  2. 其次,有点卡(当然只是导入,以及大幅度翻页的时候会容易卡,但还可以接受。)
  3. 双页阅读,我这人比较喜欢双页,这样更适合大屏,以及眼睛活动,还能减少操作幅度。(不过这样可能就不太适合上下滚动翻页,就比较需要翻页。)
  4. 其实按理说,如果我在各类正版网站看是没问题的,我也经常看,花了不少钱,但是我总觉得,那些书,我看了,仍然不是我的,书籍以本地形式存储更有一种安心的感觉,类似放在家里书房,闲着没事就来看看。
  5. 书页宽度,我知道能改,但难道每次看书我都要改,不看又要改回来吗,这也是我说要双页阅读的原因,这样不管怎么样起码不会看着看着丢行。
  6. 其实按理来说,如果接入开源阅读会是个比较好的选择,可惜那个无 pc 版,而且如果以浏览器访问,效果不太好。
  • 思源笔记

    思源笔记是一款隐私优先的个人知识管理系统,支持完全离线使用,同时也支持端到端加密同步。

    融合块、大纲和双向链接,重构你的思维。

    19819 引用 • 75899 回帖

相关帖子

欢迎来到这里!

我们正在构建一个小众社区,大家在这里相互信任,以平等 • 自由 • 奔放的价值观进行分享交流。最终,希望大家能够找到与自己志同道合的伙伴,共同成长。

注册 关于
请输入回帖内容 ...
  • 你这些需求不太建议用思源实现,还是看看有没有其他替代品吧

    1 回复
  • 纯 txt 的直接用专门的 APP 看就行了,阅读啥的。如果要导入思源看,就要先在外面预处理一下,这种也很多教程,批量替换啥的,加上标题、分开章节甚至分开文档。

    1 回复
  • 5Z4Uo6oGvKPB7o 2 赞同

    你的需求内容是一款阅读器的功能。思源是笔记软件,可能不太适合。

    可以考虑 txt 导入微信读书,移动端 + 网页端阅读体验都挺好的,而且可以自动同步阅读进度(这一点思源笔记也做不到)。读完后结合思源笔记集市的【微信读书】插件,可以同步划线笔记等内容。

    1 回复
  • 😄 我之前想这样看,结果发现太弱了。后来还是在 word 里面看

    替换格式把带章节的替换成标题格式、也支持双页

    1 回复
  • 我曾经处理过,用替换功能,将章节名替换为 思源的标题,这样思源的大纲就是书的目录了,然后导出 epub…剩下的就是阅读器的事了。

    1 回复
  • 各个地方下载的 txt 都不太一样,如何识别标题都不一定。我都是看情况改改自己之前的 py 脚本。做成 md,然后决定导入 sy 或者制作为 epub。

    1 回复
  • abbj 1 赞同

    我在 chatgpt 的帮助下写了一个类似的脚本

  • yunlunnnn

    是的,我现在就是使用微信读书,以及起点,其实问题也在这,微信读书不存在 pc 端,网页端也存在使用不太方便的问题(比如只能设置字体大小,起点也是类似,导致我只想在手机看,大屏单页阅读实在过于难受),能用,但不好用的那种,我也尝试过模拟器,但是实在是模拟器启动过慢,并且很臃肿。

    1 回复
  • yunlunnnn

    我用过开源阅读,貌似标题方面每本书都存在不同,所以就存在问题,pc 端有些阅读器貌似识别的很好,但是总有某方面不太尽人意,比如同步等

  • yunlunnnn

    这似乎也是个好方法,但是如果看的时候突然想到什么,应该就会比较难处理,可能就会存在哪一天没打开思源,只能随便找个地方记,然后后期还需要转移笔记的情况,或者需要提前在思源创建该书籍的文档,但是这样可能会在某次忘记创建,然后就想到一些灵感,然后因为创建文档空隙,然后不小心忘记灵感

    1 回复
  • yunlunnnn

    所以只是尝试询问,不太好解决的话其实也不太影响,只是我觉得这是一个可能的思路。

  • yunlunnnn

    是的,的确是,主要是没太找到比较好的 pc 端阅读器,有些比较小众的,pc 和 pe 方面的同步存在一定问题,所以也在找

  • yunlunnnn

    主要是现在网页端的阅读网站都总有一种 pc 与狗不得入内的感觉,不好用。

  • 用微信读书即可

  • 可以试试油猴脚本 微信读书 (greasyfork.org)

    image.png

    1 回复
  • 我是这样使用的,思源作为一个笔记整理结果的汇集地,其他零散的记录在别的地方,比如浏览器剪藏、备忘录、word、pdf 等等。

    这种长文本的我个人习惯是在 word 中处理,可以加背景、调顺序、变颜色、写批注(这个批注用来记疑惑、灵感等),整个常文本都读完之后再根据标记的这些内容读一遍,然后没啥问题了往思源整理,这个时候疑惑、灵感都有了回答

    1 回复
  • calibre + koreader. 这套组合的唯一缺点是没有覆盖 ios

    1 回复
  • yunlunnnn

    好的,感谢

  • yunlunnnn 1 赞同

    主要是觉得分散在各个软件处理太多麻烦,不太喜欢做太多无意义的事,并且很多时候会存在很大局限性,所以宁愿接受一点功能降级,也想尝试一站式解决问题,现在看来确实要求有些高了,不过我觉得未来会有的。

    1 回复
  • yunlunnnn

    好的,我会尝试一下的。

  • 看到思源集市这个插件预览图,好像可以实现双页浏览,可以试试。

    关于 txt 内容章节设置标题,我的方法是在 sublime 中使用正则表达式批量替换的。比如有的书籍是“第一章”“第一节”,那就替换成“# 第一章”“## 第一节”,另存为 md 格式,导入思源笔记就可以。

    image.png

    这是以前替换标题时常用的几组正则表达式

    image.png

  • 一站式很难,而且即便出来了一站式的软件 成本上 普通用户也接受不了,属于富人不愿意买 穷人买不起的情况。这样还不如自己开发

  • sky2023

    看书建议用看书软件

请输入回帖内容 ...

推荐标签 标签

  • jsDelivr

    jsDelivr 是一个开源的 CDN 服务,可为 npm 包、GitHub 仓库提供免费、快速并且可靠的全球 CDN 加速服务。

    5 引用 • 31 回帖 • 52 关注
  • 微软

    微软是一家美国跨国科技公司,也是世界 PC 软件开发的先导,由比尔·盖茨与保罗·艾伦创办于 1975 年,公司总部设立在华盛顿州的雷德蒙德(Redmond,邻近西雅图)。以研发、制造、授权和提供广泛的电脑软件服务业务为主。

    8 引用 • 44 回帖
  • 支付宝

    支付宝是全球领先的独立第三方支付平台,致力于为广大用户提供安全快速的电子支付/网上支付/安全支付/手机支付体验,及转账收款/水电煤缴费/信用卡还款/AA 收款等生活服务应用。

    29 引用 • 347 回帖 • 1 关注
  • Mobi.css

    Mobi.css is a lightweight, flexible CSS framework that focus on mobile.

    1 引用 • 6 回帖 • 708 关注
  • V2Ray
    1 引用 • 15 回帖
  • OnlyOffice
    4 引用 • 15 关注
  • 职场

    找到自己的位置,萌新烦恼少。

    126 引用 • 1699 回帖
  • Webswing

    Webswing 是一个能将任何 Swing 应用通过纯 HTML5 运行在浏览器中的 Web 服务器,详细介绍请看 将 Java Swing 应用变成 Web 应用

    1 引用 • 15 回帖 • 632 关注
  • JVM

    JVM(Java Virtual Machine)Java 虚拟机是一个微型操作系统,有自己的硬件构架体系,还有相应的指令系统。能够识别 Java 独特的 .class 文件(字节码),能够将这些文件中的信息读取出来,使得 Java 程序只需要生成 Java 虚拟机上的字节码后就能在不同操作系统平台上进行运行。

    180 引用 • 120 回帖
  • Oracle

    Oracle(甲骨文)公司,全称甲骨文股份有限公司(甲骨文软件系统有限公司),是全球最大的企业级软件公司,总部位于美国加利福尼亚州的红木滩。1989 年正式进入中国市场。2013 年,甲骨文已超越 IBM,成为继 Microsoft 后全球第二大软件公司。

    103 引用 • 126 回帖 • 442 关注
  • JWT

    JWT(JSON Web Token)是一种用于双方之间传递信息的简洁的、安全的表述性声明规范。JWT 作为一个开放的标准(RFC 7519),定义了一种简洁的,自包含的方法用于通信双方之间以 JSON 的形式安全的传递信息。

    20 引用 • 15 回帖 • 19 关注
  • Kafka

    Kafka 是一种高吞吐量的分布式发布订阅消息系统,它可以处理消费者规模的网站中的所有动作流数据。 这种动作(网页浏览,搜索和其他用户的行动)是现代系统中许多功能的基础。 这些数据通常是由于吞吐量的要求而通过处理日志和日志聚合来解决。

    35 引用 • 35 回帖 • 4 关注
  • GitLab

    GitLab 是利用 Ruby 一个开源的版本管理系统,实现一个自托管的 Git 项目仓库,可通过 Web 界面操作公开或私有项目。

    46 引用 • 72 回帖 • 1 关注
  • FlowUs

    FlowUs.息流 个人及团队的新一代生产力工具。

    让复杂的信息管理更轻松、自由、充满创意。

    1 引用
  • Ngui

    Ngui 是一个 GUI 的排版显示引擎和跨平台的 GUI 应用程序开发框架,基于
    Node.js / OpenGL。目标是在此基础上开发 GUI 应用程序可拥有开发 WEB 应用般简单与速度同时兼顾 Native 应用程序的性能与体验。

    7 引用 • 9 回帖 • 356 关注
  • 负能量

    上帝为你关上了一扇门,然后就去睡觉了....努力不一定能成功,但不努力一定很轻松 (° ー °〃)

    87 引用 • 1206 回帖 • 449 关注
  • 小薇

    小薇是一个用 Java 写的 QQ 聊天机器人 Web 服务,可以用于社群互动。

    由于 Smart QQ 从 2019 年 1 月 1 日起停止服务,所以该项目也已经停止维护了!

    34 引用 • 467 回帖 • 711 关注
  • SQLServer

    SQL Server 是由 [微软] 开发和推广的关系数据库管理系统(DBMS),它最初是由 微软、Sybase 和 Ashton-Tate 三家公司共同开发的,并于 1988 年推出了第一个 OS/2 版本。

    19 引用 • 31 回帖
  • BookxNote

    BookxNote 是一款全新的电子书学习工具,助力您的学习与思考,让您的大脑更高效的记忆。

    笔记整理交给我,一心只读圣贤书。

    1 引用 • 1 回帖 • 1 关注
  • Love2D

    Love2D 是一个开源的, 跨平台的 2D 游戏引擎。使用纯 Lua 脚本来进行游戏开发。目前支持的平台有 Windows, Mac OS X, Linux, Android 和 iOS。

    14 引用 • 53 回帖 • 517 关注
  • Node.js

    Node.js 是一个基于 Chrome JavaScript 运行时建立的平台, 用于方便地搭建响应速度快、易于扩展的网络应用。Node.js 使用事件驱动, 非阻塞 I/O 模型而得以轻量和高效。

    138 引用 • 268 回帖 • 147 关注
  • Postman

    Postman 是一款简单好用的 HTTP API 调试工具。

    4 引用 • 3 回帖
  • VirtualBox

    VirtualBox 是一款开源虚拟机软件,最早由德国 Innotek 公司开发,由 Sun Microsystems 公司出品的软件,使用 Qt 编写,在 Sun 被 Oracle 收购后正式更名成 Oracle VM VirtualBox。

    10 引用 • 2 回帖 • 8 关注
  • OpenStack

    OpenStack 是一个云操作系统,通过数据中心可控制大型的计算、存储、网络等资源池。所有的管理通过前端界面管理员就可以完成,同样也可以通过 Web 接口让最终用户部署资源。

    10 引用 • 1 关注
  • jsoup

    jsoup 是一款 Java 的 HTML 解析器,可直接解析某个 URL 地址、HTML 文本内容。它提供了一套非常省力的 API,可通过 DOM,CSS 以及类似于 jQuery 的操作方法来取出和操作数据。

    6 引用 • 1 回帖 • 477 关注
  • 反馈

    Communication channel for makers and users.

    124 引用 • 907 回帖 • 210 关注
  • API

    应用程序编程接口(Application Programming Interface)是一些预先定义的函数,目的是提供应用程序与开发人员基于某软件或硬件得以访问一组例程的能力,而又无需访问源码,或理解内部工作机制的细节。

    76 引用 • 429 回帖