AI 转文字

AI 转文字 公开 已提交,待审核

如何安装动作?

适用于
分类(旧)
图片操作 文本处理 AI
关键词



更多信息
分享时间 12小时42分钟前
最后更新 12小时42分钟前
修订版本 1
用户许可 可自己使用或修改,不可再分享
Quicker版本 1.45.5
动作大小 105.5 KB

分享到

「用本地小模型将PDF或图片里的文字内容,提取出来做成Markdown文档,保留标题层级、表格、流程图等排版信息」

简介

用途场景:

本动作适合处理含有隐私信息的 pdf 、图片,比如:法律文件的pdf版本、医疗文书的照片。 这些文件往往在去隐私前,不好直接发到云端大模型处理,先使用本动作处理成 Markdown 文档做就可以方便下一步去隐私化进而方便上传云端大模型处理。

功能:

本动作将pdf、图片等文字内容用AI读取出来,并以Markdown语法保持其基本的排版格式,比如:标题层级、加粗文字、表格、流程图等

用法:

①其过程用用到一至两个 ollama 本地小模型。所以需要下载ollama。 10-12GB显存推荐 qwen3-vl:4b-instruct 模型做 视觉处理 ,推荐 pierreprudh/gemma4-12b-mtp:latest 模型做校正处理 。 当然也可根据自己的设备与爱好的模型来 自行调整 。 ②内置预设提示词,也可自己编写提示词

作者所声明的动作特征:
  • 依赖第三方软件(如ffmpeg): ollama

最近更新

修订版本 更新时间 制品 审核状态 更新说明
1 12小时42分钟前 V1 当前 V1 版本

最近讨论

暂无讨论