Drowseは、大規模言語モデルの機構的解釈可能性のためのローカル作業台であり、ダッシュボード、Python API、OpenAI/Ollama互換サーバを提供する。アクティベーションsteering、概念プローブ、多様体、SAE、ヤコビアンレンズなどを備える。
オープンソース。新しい可能性。
優れたオープンソースプロジェクトを見つけ、匿名でプロジェクトを投稿し、自分のプロジェクトを申請して編集できます。
好奇心とともに、オープンソースの世界へ。
THE FIRST COLLECTIONDocsGPTは、ドキュメント分析、マルチモデル対応、エンタープライズ検索機能を備えた、インテリジェントなエージェントやアシスタントを構築するためのオープンソースAIプラットフォームです。
『AI Engineering from Scratch』は、APIラッパーではなく第一原理からAIエンジニアリングを教える無料・MITライセンスのカリキュラム兼リファレンスマニュアル。20フェーズ・523レッスン(約342時間)で、Python・TypeScript・Rust・Juliaによる実装を収録。各レッスンは数学ベースの自作、フレームワーク利用、再利用成果物の作成で構成され、AIチューター機能やClaude認定試験対策も備える。
生成AIを形作った107の重要な研究論文を、要約・学習ロードマップ・用語集・意思決定ガイドとともに体系的に整理した厳選リポジトリ。高度なAI研究を誰にでもアクセスしやすくする教育リソースです。
txtaiはセマンティック検索、LLMオーケストレーション、複合な言語モデルワークフローを構築するための包括的なAIフレームワークです。ベクトルインデックス、グラフネットワーク、リレーショナルデータベースを統合した埋め込みデータベースを中核に据えています。
PyTorchによるLLMのゼロからのトレーニングガイド。Transformerの実装、プリトレーニング、SFT、DPO、PPO、GRPOを含む完全なパイプラインを提供。
Xinferenceは、言語・音声・マルチモーダルモデルの提供に対応した統合推論ライブラリです。OpenAI互換RESTful API、異種GPU/CPU活用、分散配置を提供し、LangChain、LlamaIndex、Dify、Chatboxと連携します。
LlamaFactoryは100以上の大規模言語モデルとマルチモーダルモデルの効率的なファインチューニングを可能にするPythonフレームワークで、ゼロコードCLI、Gradio Web UI、LoRA/QLoRA、複数の学習アルゴリズムを提供します。
PEFTは、計算コストとストレージコストを最小限に抑えて大規模な学習済みモデルを適応させるための、最先端のパラメータ効率的なファインチューニング手法を提供するライブラリです。
初心者向けの無料Microsoftコース全21回で、LLM、プロンプトエンジニアリング、RAG、エージェント、ファインチューニングなどをPython/TypeScriptの例とともに学び、生成AIアプリを構築できる。
SANAは、高解像度の画像・動画生成に向けたNVIDIAのオープンソース高効率拡散モデル群であり、学習・推論コード、線形アテンション、DC-AE圧縮、4ビット展開を備える。
『Build a Large Language Model (From Scratch)』の公式コードリポジトリ。GPT系モデルの事前学習と微調整を段階的にPyTorchで実装し、ノートブックと演習を提供。
labml.aiは60以上のPyTorch実装を公開しており、各論文・アルゴリズムに解説を付した教育コンテンツ。Transformer、拡散モデル、GAN、強化学習、オプティマイザ、アーキテクチャなどをカバー。