graphify支持哪些文件类型?40+代码、文档、PDF、图片、视频完整清单
graphify支持哪些文件类型40代码、文档、PDF、图片、视频完整清单【免费下载链接】graphifyTurn any codebase, with its docs, SQL schemas, configs, and PDFs, into a queryable knowledge graph. A /graphify skill for Claude Code, Cursor, Codex, and Gemini CLI: local deterministic AST parsing, every edge explained, no vector store.项目地址: https://gitcode.com/GitHub_Trending/graph/graphifygraphify 是一款把任意代码库连同文档、SQL 架构、配置文件和 PDF 一起变成可查询知识图谱的工具。它的核心卖点是本地确定性 AST 解析代码不经过大模型、不离开你的机器每条边都带解释标签。那么 graphify 到底支持哪些文件类型本文给出完整清单36 个 tree-sitter 语法覆盖 40 编程语言、70 文件扩展名外加 Markdown 文档、PDF、Office、图片、音视频甚至 YouTube 链接全部都能映射进同一张图。一、代码文件40 语言、70 扩展名本地免费解析代码是 graphify 的强项。所有代码文件由本地的 tree-sitter 做确定性 AST 解析——不需要 API Key、不消耗 LLM 额度calls/imports/inherits等跨文件关系都能自动解析。支持情况按类别整理如下类别支持的扩展名 Python.py JavaScript / TypeScript.js .jsx .mjs .ts .tsx .mts .cts☕ JVM 系.java .kt .kts .scala .groovy .gradle C / C / 系统语言.c .h .cpp .cc .cxx .hpp .cu .cuh .metal .go .rs .zig C# / .NET.cs .xaml .razor .cshtml .sln .slnx .csproj .fsproj .vbproj 移动 / 应用.swift .m .mm .dart 前端框架.vue .svelte .astro PHP / Ruby.php .rb 脚本语言.sh .bash .ps1 .psm1 .psd1 .lua .luau .toc .ex .exs .jl️ SQL / 数据库.sql⚙️ 硬件 / 架构描述.v .sv .svhVerilog / SystemVerilog Fortran.f .f90 .f95 .f03 .f08️ Pascal / Delphi.pas .pp .dpr .dpk .lpr .inc .dfm .lfm .lpk BYOND DreamMaker.dm .dme .dmi .dmm .dmf 配置.json 部分扩展需要安装对应的可选依赖包才能启用语法级解析例如 BYOND[dm]、Terraform / HCL 的.tf .tfvars .hcl[terraform]、Pascal 精确解析[pascal]缺省时自动回退到正则提取器。除代码外还有两类半代码文件走确定性解析通道Salesforce Apex.cls、.trigger提取类、接口、枚举、方法及 SOQL/DML 关系边MCP 配置文件.mcp.json、mcp.json、mcp_servers.json、claude_desktop_config.json提取 MCP 服务器节点、包引用和环境变量依赖二、文档与配置文件不只是 Markdown文档类文件会经过语义提取调用你 AI 助手的模型把概念节点和文档之间的引用关系也连成边类型扩展名说明 Markdown 系.md .mdx .qmdtext链接和[[wikilinks]]会生成文档间的references边 通用文档.txt .rst .html纯文本、reStructuredText、网页⚙️ 结构化配置.yaml .yml配置文件同样可入图 学术论文Office.docx .xlsx需要[office]依赖标题层级和表格会转成 Markdown☁️ Google Workspace.gdoc .gsheet .gslides需要gws认证 --google-workspaceSheets 还需[google]依赖一个小细节如果.md文件内容带有 arXiv ID、Abstract、编号引用等学术特征graphify 会自动把它识别为**论文paper**而不是普通文档走更合适的提取策略。包清单文件pyproject.toml、Cargo.toml、go.mod、pom.xml、apm.yml是特殊公民它们被确定性地解析为每个包一个规范节点 depends_on边同一个包被 N 个清单引用时只会塌缩成一个枢纽节点不会炸出 N 个重复节点。三、PDF、图片、音视频超出代码的边界这是 graphify 与纯代码工具的分水岭——媒体文件全部进入同一张知识图谱类型扩展名处理方式 PDF.pdf本地用 pypdf 提取文本再走语义提取需要[pdf]依赖️ 图片.png .jpg .jpeg .gif .webp .svg视觉模型识别图片内容并生成节点 视频 / 音频.mp4 .mov .webm .mkv .avi .m4v .mp3 .wav .m4a .ogg本地 faster-whisper 转写需要[video]依赖 在线视频任意 YouTube 等视频 URL通过/graphify add url抓取、转写并入图隐私说明代码和视频/音频都在本地处理不离开你的机器只有文档、PDF 和图片的语义提取会调用模型用你 AI 助手当前会话的模型或你配置的 API Key。如果只想索引代码graphify extract加--code-only即可完全离线运行。四、可选依赖一次装齐所有扩展能力都以 extras 形式按需安装用 uv 安装uv tool install graphifyy[pdf] # PDF 提取 uv tool install graphifyy[office] # .docx / .xlsx uv tool install graphifyy[video] # 视频/音频转写 uv tool install graphifyy[all] # 全部装齐五、清单在哪里维护如果你想核对或扩展支持列表文件类型识别逻辑集中在 graphify/detect.pyCODE_EXTENSIONS、DOC_EXTENSIONS、PAPER_EXTENSIONS、IMAGE_EXTENSIONS、OFFICE_EXTENSIONS、VIDEO_EXTENSIONS六个集合就是权威清单包清单识别在 graphify/manifest_ingest.pyGoogle Workspace 支持在 graphify/google_workspace.py。扫描时还会自动跳过node_modules/、venv/、锁文件以及.env、私钥等敏感文件安全过滤规则同样写在 detect.py 里。总结一张图记住支持范围✅代码36 个 tree-sitter 语法、40 语言、70 扩展名本地免费解析✅文档Markdown / MDX / HTML / 纯文本 / YAML / reST✅PDF 与 Office.pdf、.docx、.xlsxGoogle Docs / Sheets / Slides 可选项✅图片PNG、JPG、GIF、WEBP、SVG✅音视频主流视频/音频格式 在线视频 URL✅配置MCP 配置、包清单、Terraform / HCL、SQL、Salesforce Apex一句话只要是代码 文档 PDF 图片 视频里任何一类graphify 都能把它塞进同一张知识图谱然后你查询它而不是 grep 它。【免费下载链接】graphifyTurn any codebase, with its docs, SQL schemas, configs, and PDFs, into a queryable knowledge graph. A /graphify skill for Claude Code, Cursor, Codex, and Gemini CLI: local deterministic AST parsing, every edge explained, no vector store.项目地址: https://gitcode.com/GitHub_Trending/graph/graphify创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考