Everything to Markdown by 星球小捕手
本地转换 · 文件不上传

把任何资料,
变成 AI 读得懂的 Markdown

Everything to Markdown 把各种资料——Word、PPT、Excel、PDF、ODF、RTF、EPUB、CSV—— 一键转成干净、结构化、AI 可直接读取的 Markdown 文件。 基于开源模型,在浏览器本地运行,文件永远不离开你的电脑。

  • .doc
  • .docx
  • .docm
  • .ppt
  • .pptx
  • .xls
  • .xlsx
  • .odt
  • .ods
  • .odp
  • .rtf
  • .epub
  • .csv
  • .pdf

手边没有文档?试试示例:

它是怎么做到的

Everything to Markdown 不靠上传服务器,也不靠机器学习模型去"猜"内容,而是用一条确定性的解析管线: 先把不同格式还原成结构化文本,再序列化成 Markdown。下面四点是它的核心思路。

统一文档模型
每种格式先被解析进同一个中间文档模型——标题、段落、列表、表格、脚注都有统一表示,再走同一套 Markdown 序列化器。所以无论来源是 2003 年的 .doc 还是昨天的 .pptx,层级与嵌套表现都一致。
内容识别,不看扩展名
格式由文件内容本身判断:PDF 的文件头、RTF 的控制字、ZIP 包内部的类型声明……扩展名只是线索之一。改名、写错扩展名、甚至没有扩展名的文件,照样被正确识别。
纯本地,毫秒级
整套转换编译成 WebAssembly 跑在浏览器里,无服务端、无外部 API、无模型推理。中位转换时间不到 5 毫秒,文件永远不离开你的电脑。
PDF 的边界
文本型 PDF 通过本地解析提取文字层;扫描型(图片)PDF 没有文字层,需要 OCR 才能转,这超出了本地管线的范围。其余 13 种均为结构化文档,可完美转换。

关于 Everything to Markdown

Everything to Markdown星球小捕手 打造,借鉴并参考了开源文档转换模型 Firecrawl anydoc (Rust → WebAssembly,MIT 许可证)。我们把"各种资料转成 AI 能读懂的 Markdown"这件事, 做成一个简单、本地、轻量的网页工具——你拖进来任何资料,它就在你的浏览器里变成干净的结构化 Markdown。