Nano PDF:基于自然语言的命令行PDF编辑工具,支持Gemini 3 Pro图像模型
Nano PDF Editor(Nano-PDF)是一款为开发者和高频制作幻灯片的人设计的命令行 PDF 编辑工具。它基于 Google 的 Gemini 3 Pro Image(内部代号 “Nano Banana”)模型,通过自然语言指令直接对 PDF 幻灯片进行修改,不需要打开复杂的界面,也不用手动对齐图表与文字。一句命令,就能让整套 Deck 在几分钟内焕然一新,非常适合 Pitch Deck、季度汇报、产品演示、投融资路演等场景。
你可以用接近对话的方式修改幻灯片内容,例如:
Nano PDF 会将指定页面渲染为图片,结合你的文字指令,通过 Gemini 3 Pro Image 生成新的页面内容,再自动写回原 PDF 中。
很多 AI 图像生成方案会把幻灯片变成一张“死图”。
Nano PDF 使用 OCR 复写(OCR re-hydration)机制,在生成新页面后,用 Tesseract 恢复 PDF 的文字层:
这让 AI 编辑过的 Deck 更适合实际工作流和协同项目。
如果需要补充新的页面,例如:
"Title slide with 'Q3 2025 Review'""Summary slide with key takeaways as bullet points"通过 nano-pdf add 命令即可插入全新页面。
工具会根据已有页面的视觉风格(字体、颜色、布局)自动匹配,让新增页面看起来就像本来就属于这套 Deck。
Nano PDF 支持一次性编辑多页,并行处理以提升速度,例如:
nano-pdf edit my_deck.pdf
1 "Update date to Oct 2025"
5 "Add company logo"
10 "Fix typo in footer"
在单次命令中,你可以指定不同页面的不同修改指令。
工具支持 4K / 2K / 1K 三档分辨率,可在质量与成本之间自由平衡。
--style-refs "1,5" 指定页面,用作视觉风格参考。整个过程在多页并行完成,兼顾速度与质量。
支持通过 Python 生态或现代工具链安装:
pip install nano-pdf
uvx nano-pdf edit my_deck.pdf 2 "Your edit here"
Nano PDF 依赖 Gemini 3 Pro Image,因此需要:
export GEMINI_API_KEY="your_api_key_here"
工具还提供 --disable-google-search 选项,用于禁止模型在生成前使用 Google 搜索能力。
编辑单页标题或文案,例如修改第 2 页标题:
nano-pdf edit my_deck.pdf 2 "Change the title to 'Q3 Results'"
一条命令中修改多个页面的不同元素:
nano-pdf edit my_deck.pdf
1 "Update date to Oct 2025"
5 "Add company logo"
在开头添加标题页,或在中间插入总结页:
# 在开头插入标题页
nano-pdf add my_deck.pdf 0 "Title slide with 'Q3 2025 Review'"
# 在第 5 页后插入总结页
nano-pdf add my_deck.pdf 5 "Summary slide with key takeaways as bullet points"
支持通过 --output "new.pdf" 指定输出文件名,以及通过 --use-context / --no-use-context 控制是否将整份 PDF 文本作为上下文,提高生成精准度。
GitHub地址:https://github.com/gavrielc/Nano-PDF
💬 评论