AIエージェントにオープンソース分析を頼む? 500MBのリポ全体を
/tmpにクローン。もう一度頼む? またクローン…トークンも時間も無駄。ウェブ検索で分析させる? 実際のコードを読むより精度は低く、ハルシネーションは多く、トークン消費もさらに多い。もうその必要はありません。 必要なフォルダだけダウンロードするか、rawリンクだけ抽出して直接使えます。
🚀 rawリンクをNotebookLMに入れれば、どんなGitHubリポからでも自分だけのDeep Wikiが作れます。
| 入力 | → | 出力 | ユースケース |
|---|---|---|---|
| GitHub特定フォルダ | → | Raw URLリスト | NotebookLM、LLMへ投入 |
| GitHub特定フォルダ | → | ファイルダウンロード | 部分クローン(リポ全体不要) |
curl -sL https://raw.githubusercontent.com/professional-ALFIE/github-extractor/master/install.sh | bash~/.claude/skills/github-extractor/にスキルとスクリプトがインストールされます。
GitHub特定パスのraw URLリストを抽出します。
なぜgit cloneを使わない? フォルダ1つだけ必要なのに、500MBのリポ全体をダウンロードする必要はありません。
./extractor_githubRawLinks.py https://github.com/owner/repo/tree/main/docs出力:
https://raw.githubusercontent.com/owner/repo/main/docs/guide.md
https://raw.githubusercontent.com/owner/repo/main/docs/api.md
- クリップボードに自動コピー(macOS)
- あらゆるブランチ、タグ、コミットに対応
要件: Python 3 + requests
ヒント:
GITHUB_TOKENを設定するとレートリミットが増加します!(60 → 5000リクエスト/時間)
GitHub特定ディレクトリのファイルのみダウンロード — フルクローン不要。
./extractor_githubRawFiles.py https://github.com/owner/repo/tree/main/docs ./local-docs自動除外: node_modules/, .git/, __pycache__/, dist/, build/, .next/, venv/, .pyc, .exe, .dll, .so
要件: Python 3 + requests
ヒント:
GITHUB_TOKENを設定するとレートリミットが増加します!(60 → 5000リクエスト/時間)
スキルをインストールしたら、こう聞くだけ:
- 「https://github.com/owner/repo/tree/main/docs のrawリンクを取得して」
- 「https://github.com/owner/repo/tree/main/src のファイルをダウンロードして」
MIT