下に引いて戻る
PixelClaw:画像編集に特化した大規模言語モデルエージェント

PixelClaw:画像編集に特化した大規模言語モデルエージェント

PixelClaw: an LLM agent for image manipulation

画像処理に特化した大規模言語モデル(LLM)エージェントを開発しました。以下の機能を統合しています:会話、計画、ツール使用のための大規模言語モデル(複数のLLMに対応)、gpt-imageによる画像生成とAIベースの編集、rembgによる背景除去(複数の専門モデルを搭載)、pyxelateを使用したピクセル化、カスタムアルゴリズムによるポスタライズとフリンジング除去、音声テキスト変換(Whisper)とテキスト音声変換(KokoroとHALO)、Raylib ベースの使いやすいUI(ファイルのドラッグアンドドロップ対応)。PixelClawは完全無料でオープンソースです。