思源笔记 Mac 端的 OCR 识别使用疑问

本贴最后更新于 470 天前,其中的信息可能已经东海扬尘

我在看了官方的 OCR 文档介绍后,这里说需要手动安装 Tesseract 并且勾选中文语言包

image.png

因为官网没有提供直接的 mac 端安装包,所以我是通过 brew 安装的 tesseract,测试已经能够正常使用命令

image.png

然后再去他的语言支持仓库获取中文包,放入 tesseract 的 tessdata 文件夹中

image.png

但是重启思源笔记后导出日志发现并没有启动 ocr.go 的相关日志

请问对于 mac 端有没有更加详细的使用方案

  • 思源笔记

    思源笔记是一款隐私优先的个人知识管理系统,支持完全离线使用,同时也支持端到端加密同步。

    融合块、大纲和双向链接,重构你的思维。

    18794 引用 • 70299 回帖
  • Q&A

    提问之前请先看《提问的智慧》,好的问题比好的答案更有价值。

    6582 引用 • 29555 回帖 • 249 关注

相关帖子

欢迎来到这里!

我们正在构建一个小众社区,大家在这里相互信任,以平等 • 自由 • 奔放的价值观进行分享交流。最终,希望大家能够找到与自己志同道合的伙伴,共同成长。

注册 关于
请输入回帖内容 ...
  • 我的也一样识别不了,我是用的 brew install tesseract-langimage.png

  • 其他回帖
  • SilentStone
    作者

    我从源码编译了一份思源笔记,然后运行后发现 tesseract 的运行了的

    image.png

    1 回复
  • SilentStone
    作者

    在尝试 brew install tesseract-lang 安装的语言包后,ocr 好像还是没有开启

    image.png

    1 回复
  • SilentStone
    作者

    I 2023/01/17 13:54:07 runtime.go:46: kernel is booting:

    • ver [2.7.0]
    • arch [arm64]
    • pid [26197]
    • runtime mode [prod]
    • working directory [/Applications/SiYuan.app/Contents/Resources]
    • read only [false]
    • container [std]
    • database [ver=20220501]
    • workspace directory [/Users/xxx/Documents/思源笔记/SiYuan]
      I 2023/01/17 13:54:07 conf.go:317: user has disabled [Google Analytics]
      I 2023/01/17 13:54:07 runtime.go:91: use network proxy [system]
      I 2023/01/17 13:54:07 serve.go:111: kernel [pid=26197] http server [127.0.0.1:54799] is booting
      I 2023/01/17 13:54:07 conf.go:616: database size [31 MB], tree/block count [568/10229]
      I 2023/01/17 13:54:07 working.go:157: kernel booted
      I 2023/01/17 13:54:07 working.go:396: built-in pandoc [ver=2.19.2, bin=/Users/xxx/Documents/思源笔记/SiYuan/temp/pandoc/bin/pandoc]
      I 2023/01/17 13:54:08 serve.go:124: reverse proxy server [127.0.0.1:6806] is booting
      I 2023/01/17 13:54:53 database.go:98: reinitialized database [/Users/xxx/Documents/思源笔记/SiYuan/temp/siyuan.db]
      I 2023/01/17 13:54:53 index.go:186: rebuilt database for notebook [20221205220353-6ffaoz7] in [0.01s], tree [count=1, size=31 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20221205163122-i4n8hwz] in [0.65s], tree [count=400, size=4.3 MB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20230109163831-tmng47v] in [0.01s], tree [count=4, size=35 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20221206081605-pcqqz0k] in [0.07s], tree [count=30, size=384 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20221205155615-dbrvp6j] in [0.01s], tree [count=12, size=36 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20221205142854-vj4jac8] in [0.09s], tree [count=40, size=604 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20230111163951-l5lacom] in [0.01s], tree [count=8, size=28 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20230111163956-a7wzh5b] in [0.00s], tree [count=3, size=5.3 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20230115180352-jlkqv7v] in [0.00s], tree [count=3, size=6.5 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20221208011037-4ww2jwd] in [0.04s], tree [count=10, size=81 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20221205200214-pneevtg] in [0.01s], tree [count=2, size=26 kB]
      I 2023/01/17 13:54:54 index.go:186: rebuilt database for notebook [20210808180117-czj9bvb] in [0.17s], tree [count=55, size=1.1 MB]
      I 2023/01/17 13:54:54 index.go:257: resolved refs [1507] in [68ms]
      I 2023/01/17 13:55:07 box.go:80: auto stat [trees=568, blocks=10229, dataSize=126 MB, assetsSize=98 MB]
      I 2023/01/17 13:55:07 disk.go:33: disk usage [total=995 GB, used=498 GB, free=497 GB]
  • 查看全部回帖

推荐标签 标签

  • 强迫症

    强迫症(OCD)属于焦虑障碍的一种类型,是一组以强迫思维和强迫行为为主要临床表现的神经精神疾病,其特点为有意识的强迫和反强迫并存,一些毫无意义、甚至违背自己意愿的想法或冲动反反复复侵入患者的日常生活。

    15 引用 • 161 回帖 • 2 关注
  • Solidity

    Solidity 是一种智能合约高级语言,运行在 [以太坊] 虚拟机(EVM)之上。它的语法接近于 JavaScript,是一种面向对象的语言。

    3 引用 • 18 回帖 • 349 关注
  • 微信

    腾讯公司 2011 年 1 月 21 日推出的一款手机通讯软件。用户可以通过摇一摇、搜索号码、扫描二维码等添加好友和关注公众平台,同时可以将自己看到的精彩内容分享到微信朋友圈。

    129 引用 • 793 回帖
  • Google

    Google(Google Inc.,NASDAQ:GOOG)是一家美国上市公司(公有股份公司),于 1998 年 9 月 7 日以私有股份公司的形式创立,设计并管理一个互联网搜索引擎。Google 公司的总部称作“Googleplex”,它位于加利福尼亚山景城。Google 目前被公认为是全球规模最大的搜索引擎,它提供了简单易用的免费服务。不作恶(Don't be evil)是谷歌公司的一项非正式的公司口号。

    49 引用 • 192 回帖
  • 负能量

    上帝为你关上了一扇门,然后就去睡觉了....努力不一定能成功,但不努力一定很轻松 (° ー °〃)

    85 引用 • 1201 回帖 • 449 关注
  • 30Seconds

    📙 前端知识精选集,包含 HTML、CSS、JavaScript、React、Node、安全等方面,每天仅需 30 秒。

    • 精选常见面试题,帮助您准备下一次面试
    • 精选常见交互,帮助您拥有简洁酷炫的站点
    • 精选有用的 React 片段,帮助你获取最佳实践
    • 精选常见代码集,帮助您提高打码效率
    • 整理前端界的最新资讯,邀您一同探索新世界
    488 引用 • 383 回帖 • 5 关注
  • BND

    BND(Baidu Netdisk Downloader)是一款图形界面的百度网盘不限速下载器,支持 Windows、Linux 和 Mac,详细介绍请看这里

    107 引用 • 1281 回帖 • 26 关注
  • Wide

    Wide 是一款基于 Web 的 Go 语言 IDE。通过浏览器就可以进行 Go 开发,并有代码自动完成、查看表达式、编译反馈、Lint、实时结果输出等功能。

    欢迎访问我们运维的实例: https://wide.b3log.org

    30 引用 • 218 回帖 • 603 关注
  • 架构

    我们平时所说的“架构”主要是指软件架构,这是有关软件整体结构与组件的抽象描述,用于指导软件系统各个方面的设计。另外还有“业务架构”、“网络架构”、“硬件架构”等细分领域。

    140 引用 • 441 回帖 • 1 关注
  • 程序员

    程序员是从事程序开发、程序维护的专业人员。

    534 引用 • 3528 回帖
  • 资讯

    资讯是用户因为及时地获得它并利用它而能够在相对短的时间内给自己带来价值的信息,资讯有时效性和地域性。

    53 引用 • 85 回帖 • 2 关注
  • 开源

    Open Source, Open Mind, Open Sight, Open Future!

    396 引用 • 3416 回帖
  • RYMCU

    RYMCU 致力于打造一个即严谨又活泼、专业又不失有趣,为数百万人服务的开源嵌入式知识学习交流平台。

    4 引用 • 6 回帖 • 40 关注
  • 微服务

    微服务架构是一种架构模式,它提倡将单一应用划分成一组小的服务。服务之间互相协调,互相配合,为用户提供最终价值。每个服务运行在独立的进程中。服务于服务之间才用轻量级的通信机制互相沟通。每个服务都围绕着具体业务构建,能够被独立的部署。

    96 引用 • 155 回帖
  • 快应用

    快应用 是基于手机硬件平台的新型应用形态;标准是由主流手机厂商组成的快应用联盟联合制定;快应用标准的诞生将在研发接口、能力接入、开发者服务等层面建设标准平台;以平台化的生态模式对个人开发者和企业开发者全品类开放。

    15 引用 • 127 回帖 • 4 关注
  • WiFiDog

    WiFiDog 是一套开源的无线热点认证管理工具,主要功能包括:位置相关的内容递送;用户认证和授权;集中式网络监控。

    1 引用 • 7 回帖 • 545 关注
  • 职场

    找到自己的位置,萌新烦恼少。

    126 引用 • 1699 回帖 • 2 关注
  • AngularJS

    AngularJS 诞生于 2009 年,由 Misko Hevery 等人创建,后为 Google 所收购。是一款优秀的前端 JS 框架,已经被用于 Google 的多款产品当中。AngularJS 有着诸多特性,最为核心的是:MVC、模块化、自动化双向数据绑定、语义化标签、依赖注入等。2.0 版本后已经改名为 Angular。

    12 引用 • 50 回帖 • 428 关注
  • DevOps

    DevOps(Development 和 Operations 的组合词)是一组过程、方法与系统的统称,用于促进开发(应用程序/软件工程)、技术运营和质量保障(QA)部门之间的沟通、协作与整合。

    40 引用 • 24 回帖 • 1 关注
  • 创造

    你创造的作品可能会帮助到很多人,如果是开源项目的话就更赞了!

    172 引用 • 990 回帖
  • NGINX

    NGINX 是一个高性能的 HTTP 和反向代理服务器,也是一个 IMAP/POP3/SMTP 代理服务器。 NGINX 是由 Igor Sysoev 为俄罗斯访问量第二的 Rambler.ru 站点开发的,第一个公开版本 0.1.0 发布于 2004 年 10 月 4 日。

    311 引用 • 546 回帖 • 34 关注
  • CSS

    CSS(Cascading Style Sheet)“层叠样式表”是用于控制网页样式并允许将样式信息与网页内容分离的一种标记性语言。

    180 引用 • 447 回帖
  • Sillot

    Sillot (汐洛)孵化自思源笔记,致力于服务智慧新彖乄,具有彖乄驱动、极致优雅、开发者友好的特点
    Github 地址:https://github.com/Hi-Windom/Sillot

    17 引用 • 6 回帖 • 26 关注
  • abitmean

    有点意思就行了

    25 关注
  • WebSocket

    WebSocket 是 HTML5 中定义的一种新协议,它实现了浏览器与服务器之间的全双工通信(full-duplex)。

    48 引用 • 206 回帖 • 395 关注
  • 运维

    互联网运维工作,以服务为中心,以稳定、安全、高效为三个基本点,确保公司的互联网业务能够 7×24 小时为用户提供高质量的服务。

    148 引用 • 257 回帖 • 1 关注
  • Typecho

    Typecho 是一款博客程序,它在 GPLv2 许可证下发行,基于 PHP 构建,可以运行在各种平台上,支持多种数据库(MySQL、PostgreSQL、SQLite)。

    12 引用 • 60 回帖 • 462 关注