1つのリポジトリに集結する自律型AIエージェントエコシステム
Andrew Ngは、エージェント型ワークフローでGPT-3.5がGPT-4を上回る可能性を示唆し、議論を巻き起こした。200以上のAIエージェントツールを厳選したカタログが、モダンなスタックを明らかにする。
言語
ホーム言語
セクション
Andrew Ngは、エージェント型ワークフローでGPT-3.5がGPT-4を上回る可能性を示唆し、議論を巻き起こした。200以上のAIエージェントツールを厳選したカタログが、モダンなスタックを明らかにする。
NVIDIAがCosmos 3を公開——テキスト、ビデオ、オーディオ、身体動作シーケンスを一つのアーキテクチャで統合したworld models。分散学習ツールと推論バックエンドを含むフレームワーク。
Outlines library guides text generation at the token level, guaranteeing valid JSON output without retries or regex fixes. Supports Pydantic schemas, regex, and multiple inference backends.
実際に動作するAIエージェントを構築するための実践ガイド。Bojie Liのai-agent-bookリポジトリでは、コンテキストエンジニアリングからファインチューニングなしの自己進化までカバーしている。
SenseNova-U1は、伝統的なエンコーダーに頼るのではなく、視覚的なコンテキストを推論することで、テキストによる画像の生成と編集を行うネイティブマルチモーダルアプローチを採用しています。
Decepticonは実際のペネトレーションテスターのように攻撃チェーンを実行する自律型Red Teamエージェント。XBOWベンチマークで98%、16の specialized agentsを使用。
ROCmをソースからビルドするのは地狱じゃない。AMD公式のビルドプラットフォーム「TheRock」が、HIPとROCmのコンパイルを管理可能なものにしてくれます。
ただチャットするだけのボットに厌倦していますか?OpenHarnessなら、言語モデルに実際の「行動力」を与えられます。ターミナルで動き、Webを閲覧し、コードを編集するAgentを作れます。
nanobotはローカルで動作するオープンソースのAIエージェントエンジンです。TelegramやDiscordとの連携、MCPツール、長期メモリをサポートし、データはクラウドに送信しません。
Apache Ossieは、ベンダーに依存しない形式で指標を一度定義すればどこでも使えるようにし、データスタックにおけるセマンティックの断片化を解決することを目指します。
MLモデルのデプロイに苦労していますか?NVIDIAのTriton Inference Serverは、動的バッチング、マルチフレームワークサポート、プロダクション対応のメトリクスをすぐに使えます。
Prime IntellectのPrime-RLは、非同期RLパイプラインで数千GPU規模のスケールでエージェントモデルを訓練するための本格的な環境を提供します。
StanfordのSNAPグループは、CRISPR実験の計画立案、scRNA-seqデータの解析、検証可能な仮説の生成を行うLLMベースのエージェント「Biomni」を公開しました。
NVIDIA ResearchのFoundationPoseは6Dポーズ推定とトラッキングを統合し、学習時に見たことのない物体でもそのまま動作します。ファインチューニング不要。
スマートグラスにAIを組み込むのにラグで頭を悩ませない方法。インスタントな関数呼び出しを実現する26Mパラメータモデル「Needle」を紹介
A fork of TradingAgents adapted for Chinese A-shares: seven specialized AI agents debate and analyze stocks before delivering investment recommendations.
Tired of Tuya devices relying on flaky Chinese cloud servers? tuya-local lets Home Assistant control them directly over your local network—no subscriptions, no delays, just instant响应.
MicrosoftのTRELLIS.2は、40億パラメータのモデルとPBRマテリアル、O-Voxel表現を使用して、数秒でレンダー可能な3Dアセットを1枚の画像から生成します。
Pixelle-Videoは、テキストプロンプトだけで短い動画を自動生成するエンジンです。ナレーション、字幕、音楽、AI生成のビジュアルを含むMP4を出力します。
マルチエージェントAIシステムの構築は、悪夢である必要はありません。Neuro SAN Studioは、延々とPythonコードを記述することなく、LLMエージェントをオーケストレーションするための宣言型設定とビジュアルエディタを提供します。
OpenManusは、ブラウザタスクやデータ分析などを自動化するオープンソースのAIエージェントです。招待制のManusの代替として、MetaGPTがわずか3時間で開発しました。
GraphRAGは非構造化データからナレッジグラフを構築し、LLMが大規模アーカイブ全体の接続を理解しグローバルな質問に回答できるようにします。
Memtraceを試しました—コードベースをAIエージェント向けのナレッジグラフに変換し、LLM呼び出しなしで15,000ファイルを1.5秒でインデックス化するツールです。
YouTubeからBilibiliへのコンテンツパイプライン全体を自動化するPythonベースの自動化ツール「Y2A-Auto」をご紹介します。ダウンロード、AI字幕翻訳、スマートメタデータ生成、公開までを一括処理します。