Loading...
Loading...
Compare original and translation side by side
from markitdown import MarkItDown
md = MarkItDown()
result = md.convert("document.pdf")
print(result.text_content)markitdown document.pdf -o output.mdreferences/document_conversion.mdfrom markitdown import MarkItDown
md = MarkItDown()
result = md.convert("document.pdf")
print(result.text_content)markitdown document.pdf -o output.mdreferences/document_conversion.mdfrom markitdown import MarkItDown
md = MarkItDown()
result = md.convert("image.jpg")
print(result.text_content) # Includes EXIF metadata and OCR textresult = md.convert("audio.wav")
print(result.text_content) # Transcribed speechreferences/media_processing.mdfrom markitdown import MarkItDown
md = MarkItDown()
result = md.convert("image.jpg")
print(result.text_content) # 包含EXIF元数据和OCR识别文本result = md.convert("audio.wav")
print(result.text_content) # 转写后的语音文本references/media_processing.mdfrom markitdown import MarkItDown
md = MarkItDown()
result = md.convert("https://youtube.com/watch?v=VIDEO_ID")
print(result.text_content)references/web_content.mdfrom markitdown import MarkItDown
md = MarkItDown()
result = md.convert("https://youtube.com/watch?v=VIDEO_ID")
print(result.text_content)references/web_content.mdfrom markitdown import MarkItDown
md = MarkItDown()
result = md.convert("data.csv")
print(result.text_content) # Formatted as Markdown tablereferences/structured_data.mdfrom markitdown import MarkItDown
md = MarkItDown()
result = md.convert("data.csv")
print(result.text_content) # 格式化为Markdown表格references/structured_data.mdfrom markitdown import MarkItDown
md = MarkItDown(docintel_endpoint="<endpoint>", docintel_key="<key>")
result = md.convert("complex.pdf")from markitdown import MarkItDown
from openai import OpenAI
client = OpenAI()
md = MarkItDown(llm_client=client, llm_model="gpt-4o")
result = md.convert("presentation.pptx") # Images described with LLMreferences/advanced_integrations.mdfrom markitdown import MarkItDown
md = MarkItDown(docintel_endpoint="<endpoint>", docintel_key="<key>")
result = md.convert("complex.pdf")from markitdown import MarkItDown
from openai import OpenAI
client = OpenAI()
md = MarkItDown(llm_client=client, llm_model="gpt-4o")
result = md.convert("presentation.pptx") # 图片将由LLM生成描述references/advanced_integrations.mdfrom markitdown import MarkItDown
md = MarkItDown()
result = md.convert("archive.zip")
print(result.text_content) # All files converted and concatenatedpython scripts/batch_convert.py /path/to/documents /path/to/outputscripts/batch_convert.pyfrom markitdown import MarkItDown
md = MarkItDown()
result = md.convert("archive.zip")
print(result.text_content) # 所有文件转换后合并输出python scripts/batch_convert.py /path/to/documents /path/to/outputscripts/batch_convert.pyuv pip install 'markitdown[all]'uv pip install 'markitdown[pdf]' # PDF support
uv pip install 'markitdown[docx]' # Word support
uv pip install 'markitdown[pptx]' # PowerPoint support
uv pip install 'markitdown[xlsx]' # Excel support
uv pip install 'markitdown[audio]' # Audio transcription
uv pip install 'markitdown[youtube]' # YouTube transcriptsuv pip install 'markitdown[all]'uv pip install 'markitdown[pdf]' # PDF支持
uv pip install 'markitdown[docx]' # Word支持
uv pip install 'markitdown[pptx]' # PowerPoint支持
uv pip install 'markitdown[xlsx]' # Excel支持
uv pip install 'markitdown[audio]' # 音频转写支持
uv pip install 'markitdown[youtube]' # YouTube字幕支持from markitdown import MarkItDown
md = MarkItDown()from markitdown import MarkItDown
md = MarkItDown()
**Document analysis pipeline:**
```bash
**文档分析流程:**
```bashundefinedundefinedfrom markitdown import MarkItDownfrom markitdown import MarkItDownundefinedundefined