思源笔记 Mac 端的 OCR 识别使用疑问

本贴最后更新于 865 天前,其中的信息可能已经东海扬尘

我在看了官方的 OCR 文档介绍后,这里说需要手动安装 Tesseract 并且勾选中文语言包

image.png

因为官网没有提供直接的 mac 端安装包,所以我是通过 brew 安装的 tesseract,测试已经能够正常使用命令

image.png

然后再去他的语言支持仓库获取中文包,放入 tesseract 的 tessdata 文件夹中

image.png

但是重启思源笔记后导出日志发现并没有启动 ocr.go 的相关日志

请问对于 mac 端有没有更加详细的使用方案

  • 思源笔记

    思源笔记是一款隐私优先的个人知识管理系统,支持完全离线使用,同时也支持端到端加密同步。

    融合块、大纲和双向链接,重构你的思维。

    25735 引用 • 106497 回帖
  • Q&A

    提问之前请先看《提问的智慧》,好的问题比好的答案更有价值。

    9863 引用 • 44825 回帖 • 77 关注

相关帖子

欢迎来到这里!

我们正在构建一个小众社区,大家在这里相互信任,以平等 • 自由 • 奔放的价值观进行分享交流。最终,希望大家能够找到与自己志同道合的伙伴,共同成长。

注册 关于
请输入回帖内容 ...
  • 我这的情况是使用 HomeBrew 安装的 Tesseract,可执行文件链接路径是 /opt/homebrew/bin/tesseract,思源笔记的源码中使用的是 /usr/local/bin/tesseract,所以 OCR 不成功。

    image.pngimage.png

  • 其他回帖
  • raymond8825 via macOS

    我的也一样识别不了,我是用的 brew install tesseract-langimage.png

  • 语言包的话也可以通过 brew 安装的,手动加入语言包的话要注意下载对应 Tesseract 的版本。

    1 回复
  • SilentStone via macOS
    作者

    I 2023/01/17 13:54:07 runtime.go:46: kernel is booting:

    • ver [2.7.0]
    • arch [arm64]
    • pid [26197]
    • runtime mode [prod]
    • working directory [/Applications/SiYuan.app/Contents/Resources]
    • read only [false]
    • container [std]
    • database [ver=20220501]
    • workspace directory [/Users/xxx/Documents/思源笔记/SiYuan]
      I 2023/01/17 13:54:07 conf.go:317: user has disabled [Google Analytics]
      I 2023/01/17 13:54:07 runtime.go:91: use network proxy [system]
      I 2023/01/17 13:54:07 serve.go:111: kernel [pid=26197] http server [127.0.0.1:54799] is booting
      I 2023/01/17 13:54:07 conf.go:616: database size [31 MB], tree/block count [568/10229]
      I 2023/01/17 13:54:07 working.go:157: kernel booted
      I 2023/01/17 13:54:07 working.go:396: built-in pandoc [ver=2.19.2, bin=/Users/xxx/Documents/思源笔记/SiYuan/temp/pandoc/bin/pandoc]
      I 2023/01/17 13:54:08 serve.go:124: reverse proxy server [127.0.0.1:6806] is booting
      I 2023/01/17 13:54:53 database.go:98: reinitialized database [/Users/xxx/Documents/思源笔记/SiYuan/temp/siyuan.db]
      I 2023/01/17 13:54:53 index.go:186: rebuilt database for notebook [20221205220353-6ffaoz7] in [0.01s], tree [count=1, size=31 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20221205163122-i4n8hwz] in [0.65s], tree [count=400, size=4.3 MB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20230109163831-tmng47v] in [0.01s], tree [count=4, size=35 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20221206081605-pcqqz0k] in [0.07s], tree [count=30, size=384 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20221205155615-dbrvp6j] in [0.01s], tree [count=12, size=36 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20221205142854-vj4jac8] in [0.09s], tree [count=40, size=604 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20230111163951-l5lacom] in [0.01s], tree [count=8, size=28 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20230111163956-a7wzh5b] in [0.00s], tree [count=3, size=5.3 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20230115180352-jlkqv7v] in [0.00s], tree [count=3, size=6.5 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20221208011037-4ww2jwd] in [0.04s], tree [count=10, size=81 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20221205200214-pneevtg] in [0.01s], tree [count=2, size=26 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20210808180117-czj9bvb] in [0.17s], tree [count=55, size=1.1 MB]
      I 2023/01/17 13:54:54 index.go:257: resolved refs [1507] in [68ms]
      I 2023/01/17 13:55:07 box.go:80: auto stat [trees=568, blocks=10229, dataSize=126 MB, assetsSize=98 MB]
      I 2023/01/17 13:55:07 disk.go:33: disk usage [total=995 GB, used=498 GB, free=497 GB]
  • 查看全部回帖

推荐标签 标签

  • JRebel

    JRebel 是一款 Java 虚拟机插件,它使得 Java 程序员能在不进行重部署的情况下,即时看到代码的改变对一个应用程序带来的影响。

    26 引用 • 78 回帖 • 677 关注
  • TextBundle

    TextBundle 文件格式旨在应用程序之间交换 Markdown 或 Fountain 之类的纯文本文件时,提供更无缝的用户体验。

    1 引用 • 2 回帖 • 84 关注
  • Rust

    Rust 是一门赋予每个人构建可靠且高效软件能力的语言。Rust 由 Mozilla 开发,最早发布于 2014 年 9 月。

    58 引用 • 22 回帖 • 10 关注
  • RESTful

    一种软件架构设计风格而不是标准,提供了一组设计原则和约束条件,主要用于客户端和服务器交互类的软件。基于这个风格设计的软件可以更简洁,更有层次,更易于实现缓存等机制。

    30 引用 • 114 回帖 • 1 关注
  • 微服务

    微服务架构是一种架构模式,它提倡将单一应用划分成一组小的服务。服务之间互相协调,互相配合,为用户提供最终价值。每个服务运行在独立的进程中。服务于服务之间才用轻量级的通信机制互相沟通。每个服务都围绕着具体业务构建,能够被独立的部署。

    96 引用 • 155 回帖 • 1 关注
  • Sphinx

    Sphinx 是一个基于 SQL 的全文检索引擎,可以结合 MySQL、PostgreSQL 做全文搜索,它可以提供比数据库本身更专业的搜索功能,使得应用程序更容易实现专业化的全文检索。

    1 引用 • 223 关注
  • 友情链接

    确认过眼神后的灵魂连接,站在链在!

    24 引用 • 373 回帖
  • 一些有用的避坑指南。

    69 引用 • 93 回帖
  • 博客

    记录并分享人生的经历。

    273 引用 • 2388 回帖
  • 正则表达式

    正则表达式(Regular Expression)使用单个字符串来描述、匹配一系列遵循某个句法规则的字符串。

    31 引用 • 94 回帖 • 1 关注
  • 设计模式

    设计模式(Design pattern)代表了最佳的实践,通常被有经验的面向对象的软件开发人员所采用。设计模式是软件开发人员在软件开发过程中面临的一般问题的解决方案。这些解决方案是众多软件开发人员经过相当长的一段时间的试验和错误总结出来的。

    200 引用 • 120 回帖
  • 反馈

    Communication channel for makers and users.

    121 引用 • 907 回帖 • 278 关注
  • CongSec

    本标签主要用于分享网络空间安全专业的学习笔记

    1 引用 • 1 回帖 • 35 关注
  • WebClipper

    Web Clipper 是一款浏览器剪藏扩展,它可以帮助你把网页内容剪藏到本地。

    3 引用 • 9 回帖 • 1 关注
  • 微软

    微软是一家美国跨国科技公司,也是世界 PC 软件开发的先导,由比尔·盖茨与保罗·艾伦创办于 1975 年,公司总部设立在华盛顿州的雷德蒙德(Redmond,邻近西雅图)。以研发、制造、授权和提供广泛的电脑软件服务业务为主。

    8 引用 • 44 回帖
  • App

    App(应用程序,Application 的缩写)一般指手机软件。

    91 引用 • 384 回帖
  • Chrome

    Chrome 又称 Google 浏览器,是一个由谷歌公司开发的网页浏览器。该浏览器是基于其他开源软件所编写,包括 WebKit,目标是提升稳定性、速度和安全性,并创造出简单且有效率的使用者界面。

    63 引用 • 289 回帖 • 1 关注
  • 小薇

    小薇是一个用 Java 写的 QQ 聊天机器人 Web 服务,可以用于社群互动。

    由于 Smart QQ 从 2019 年 1 月 1 日起停止服务,所以该项目也已经停止维护了!

    35 引用 • 468 回帖 • 761 关注
  • Lute

    Lute 是一款结构化的 Markdown 引擎,支持 Go 和 JavaScript。

    29 引用 • 202 回帖 • 27 关注
  • 深度学习

    深度学习(Deep Learning)是机器学习的分支,是一种试图使用包含复杂结构或由多重非线性变换构成的多个处理层对数据进行高层抽象的算法。

    43 引用 • 44 回帖
  • 互联网

    互联网(Internet),又称网际网络,或音译因特网、英特网。互联网始于 1969 年美国的阿帕网,是网络与网络之间所串连成的庞大网络,这些网络以一组通用的协议相连,形成逻辑上的单一巨大国际网络。

    98 引用 • 367 回帖
  • Laravel

    Laravel 是一套简洁、优雅的 PHP Web 开发框架。它采用 MVC 设计,是一款崇尚开发效率的全栈框架。

    19 引用 • 23 回帖 • 740 关注
  • 快应用

    快应用 是基于手机硬件平台的新型应用形态;标准是由主流手机厂商组成的快应用联盟联合制定;快应用标准的诞生将在研发接口、能力接入、开发者服务等层面建设标准平台;以平台化的生态模式对个人开发者和企业开发者全品类开放。

    15 引用 • 127 回帖 • 2 关注
  • ReactiveX

    ReactiveX 是一个专注于异步编程与控制可观察数据(或者事件)流的 API。它组合了观察者模式,迭代器模式和函数式编程的优秀思想。

    1 引用 • 2 回帖 • 184 关注
  • 自由行
    2 关注
  • 创业

    你比 99% 的人都优秀么?

    82 引用 • 1395 回帖
  • Ubuntu

    Ubuntu(友帮拓、优般图、乌班图)是一个以桌面应用为主的 Linux 操作系统,其名称来自非洲南部祖鲁语或豪萨语的“ubuntu”一词,意思是“人性”、“我的存在是因为大家的存在”,是非洲传统的一种价值观,类似华人社会的“仁爱”思想。Ubuntu 的目标在于为一般用户提供一个最新的、同时又相当稳定的主要由自由软件构建而成的操作系统。

    127 引用 • 169 回帖 • 1 关注