AI生图无法编辑?Crop2Draw —— 把论文架构图「拆」进 draw.io

简介: Crop2Draw 是一款开源工具,专为科研人员设计,可将论文/组会中难以编辑的位图架构图(如PDF截图、AI生成图)智能裁切、OCR识别文字,并一键导出为可编辑的 draw.io 文件,支持文字修改、颜色调整、模块重排,大幅提升复现与汇报效率。(239字)

 

前言

面向论文复现、组会汇报的人:复杂架构图是位图、字改不了、线对不齐时,怎么快速变成可编辑的 draw.io

如果你也遇到过这些场面:

  • PPT / 组会要用架构图,网上图是位图,标签和箭头改不动
  • 用截图硬抠,图层乱,外框一切就把内部模块带走
  • 想重绘又懒得从零搭方块

可以试试 Crop2Draw:对着原图手动画框,按「图片 / 白底文字 / 有色底文字」三种模式切块,一键导出可编辑的 .drawio

仓库:https://github.com/ChenAI-TGF/Crop2Draw


效果演示

这个是要复现的图:

进行挖空 一键导入Drawio 可以看到文字可编辑,字体颜色大小可变,图片可调。直接将ai生成的图处理成全部可以编辑的Drawio结构了。 接下来详细介绍

Crop2Draw 是做什么的?

一句话:把复杂示意图裁成图层,导出 draw.io

模式 适合 结果
1 图片 模块块、示意图标、彩色框 PNG 图层 + 原图挖空
2 白底文字 标题、旁注 OCR → 可编辑文字
3 有色底文字 色块上的标签 OCR + 填色

常用能力:

  • 画完框后在鼠标旁三选一(快捷键 1/2/3)
  • OCR:可以选择标准OCR或者高级OCR。标准版 OCR 不满意可一键换高精度重识  (百度API,自己配置本地的也可以但是效果稍微会差点,需要人工修正可能)
  • OCR 后可以直接用白色或者周围颜色进行替代:不会出现文字挖空后一层空白的情况
    这是挖出来的效果,可以看到文字可编辑,后面的圆角矩形也没有损坏。
  • 图片替换处理器:新图尺寸差很多也能按比例缩进目标框再覆盖
  • 一键导出并打开 draw.io Desktop

操作步骤

1. 安装与启动

   bash

git clone https://github.com/ChenAI-TGF/Crop2Draw.git
cd Crop2Draw
pip install -r requirements.txt
# 文字 OCR 才需要:
copy secrets.json.example secrets.json   # 填入百度 OCR Key
python crop_to_drawio.py path\to\figure.png

2. 先切「内部」,再切「外框」

大分区外框(Backbone、Neck、Head)往往包着内部小模块。

先切内部(如单个 C2f、Detect Head),再切外框。

Crop2Draw 会把已裁区域挖空,外框不会把里面内容一起带走。

3. 快捷键:图片用 1,文字用 2/3

  • 色块模块、示意图 → 1
  • 白底标签 → 2
  • 色底上的小字 → 3(邻域填色或取色笔)

松手后右侧出现菜单,或直接按 1 2 3

4. OCR 核对时调样式

标准版识别差时,点「用高精度版重新识别」。

标题可勾选加粗;字号按裁切框自适应,减少乱换行。

5. 图标分辨率不够时用替换处理器

打开 图片替换处理器 → 选目标裁切 → 拖图/粘贴 → 原比例缩进框内覆盖。

draw.io 几何尺寸不变,不会被拉变形。

6. 导出

一键导出并打开:有文字层时自动带半透明底图方便核对。

层级规则:先裁的在上,后裁的在下——外框后切,就不会盖住内部。


适合谁?

  • 写论文 / 做组会,要改架构图里的字和箭头
  • 不想从零重绘,又要AI生图的可编辑结果

开源协议 MIT,欢迎 Star、Issue、PR:

https://github.com/ChenAI-TGF/Crop2Draw

 

目录
相关文章
|
20小时前
|
数据采集 人工智能 运维
网络钓鱼风险下地方政府公开档案脱敏的权责边界与平衡机制研究
本文以美国大巴灵顿镇市政钓鱼诈骗及档案脱敏事件为实证,揭示公开档案成钓鱼情报源的深层风险,剖析“一刀切”脱敏损害知情权的治理偏差,提出涵盖源头防控、分级脱敏、法律约束与公众监督的四维协同治理体系,兼顾政务透明与个人信息安全。(239字)
26 3
|
20小时前
|
数据采集 人工智能 安全
地下黑产间接提示注入工具链演化、多载体攻击路径与分层防御体系研究
本文基于Proofpoint 2026年地下黑产观测报告,首次系统揭示间接提示注入(IDPI)已产业化:150美元/月订阅工具可批量生成邮件、PDF、ICS日历、恶意广告四类隐匿载荷。研究指出传统防护失效,提出“内容净化—AI隔离—权限约束—人工校验”四层纵深防御框架,填补商业化IDPI实战研究空白。(239字)
26 1
|
9月前
|
机器学习/深度学习 人工智能 自然语言处理
AI 十大论文精讲(七):Switch Routing 如何破解 MoE 的路由、通信与稳定性三大痛点
Switch Transformers通过简化MoE路由机制,实现万亿参数模型的高效训练。其核心创新在于Switch Routing(单专家激活)、选择性精度与三重并行架构,在降低计算成本的同时提升模型规模与稳定性,为大模型稀疏化发展奠定基础。
826 132
AI 十大论文精讲(七):Switch Routing 如何破解 MoE 的路由、通信与稳定性三大痛点
|
2月前
|
人工智能 安全 前端开发
来不及学 AI 就不用学了?——从 AI 到 Agent,再到 Harness Engineering 与 Loop Engineering :一条被产品化加速的技术演进线
本文是一份AI工程演进图谱,以「概念地图」形式梳理2022–2026年LLM→Agent→Harness→Loop的演进脉络,厘清OpenClaw、MCP、Skills等核心概念的关系,破除术语迷雾,强调Harness Engineering才是当前最值得投入的系统性工程能力。(239字)
316 1
|
7月前
|
存储 缓存 数据可视化
Supertonic 部署与使用全流程保姆级指南(附已部署镜像)
Supertonic开源工具Python版部署与使用指南 摘要:本文详细介绍了Supertonic(一款语音处理工具)Python版本的完整部署流程,包括服务器环境准备、源码下载、依赖安装、常见报错解决方法等关键步骤。部署成功后,用户只需修改示例脚本中的文本内容,即可生成对应的音频结果文件。文章还提供了已部署镜像的获取方式,帮助用户快速上手。部署过程中需注意模型自动下载、依赖版本冲突等常见问题。通过本指南,用户可以快速完成Supertonic的环境搭建并开始使用其核心功能。
490 8
|
2月前
|
缓存 网络协议 网络安全
Notion 图片无法查看?一分钟修复的完整实录
本文提供Notion国内访问卡顿、图片转圈/裂图/空白的合法本地解决方案。聚焦DNS解析慢、国际出口拥塞等根因,详解通过修改Hosts文件指定最优IP(如119.28.13.121)加速www.notion.so等关键域名,并附Windows操作避坑指南、一键脚本及排错清单。
500 0
|
8月前
|
机器学习/深度学习 存储 人工智能
AI 十大论文精讲(九):无损失量化革命——LLM.int8 () 破解千亿大模型内存困局
本文解读AI十大核心论文第九篇《LLM.int8()》,聚焦大模型推理中的内存瓶颈问题。该论文提出创新的混合精度量化方法,通过向量级量化与异常值分离技术,首次实现千亿参数模型无损8位量化,显著降低部署成本,提升计算效率,推动大模型在消费级硬件上的落地应用,为低比特量化研究奠定重要基础。
909 8
|
7月前
|
JSON 数据可视化 API
实用程序:解放双手!Python 打造 PDF 手写模拟器,轻松搞定手写作业
一款基于Python的PDF手写模拟器,可批量将文字以逼真手写形式填入PDF指定区域。支持中英文独立配置、手写扰动效果调节、模板复用与实时预览,告别手动抄写。开源免费,操作简便,学生党必备!GitHub已开源,欢迎Star!
649 0
|
5月前
|
Web App开发 人工智能 前端开发
CyberArcanum 赛博秘仪:当AI与塔罗相遇,我用代码重构了一场数字时代的占卜仪式
CyberArcanum 赛博秘仪是一款融合神秘学仪式与前沿AI技术的开源数字占卜工具。通过手势选牌、握拳定契、3D翻牌及DeepSeek驱动的多轮AI对谈,重构塔罗占卜的沉浸式体验,让AI成为向内探索的温暖数字导师。(239字)
641 2
|
6月前
|
传感器 人工智能 算法
从春晚舞台到全球赛场:中国人形机器人,到底走到了哪一步?
2026年央视春晚创纪录启用超200台国产人形机器人,宇树科技(武术集群)、魔法原子(街舞+熊猫狗)、松延动力(仿生小品)、银河通用(具身智能微电影)四企领衔,覆盖运动控制、集群协同、情感交互、自主决策四大技术高地,标志中国人形机器人迈入规模化落地元年。(239字)
659 2

热门文章

最新文章