Inference Broker – マルチノード対応
塾のGPUサーバーにLLM Runtime Agentを入れて、Inference Brokerのマルチノード対応をやりました。 mini01というノードがミニPCで、gpu01というノードが塾のGPUサーバーです。 そ … 続きを読む
塾のGPUサーバーにLLM Runtime Agentを入れて、Inference Brokerのマルチノード対応をやりました。 mini01というノードがミニPCで、gpu01というノードが塾のGPUサーバーです。 そ … 続きを読む
NPU搭載のPCが加わったことで、これまでのCPU/GPUを使う推論処理以外の選択肢が増えました。 この機会に、これまで開発してきたLLM BrokerとVision Brokerを統合して、推論資源の管理もできる推論プ … 続きを読む
これまで文章生成系はLLM Broker、画像処理系はVision Brokerを開発して、ZIKUUのアプリケーションや第三者のアプリケーションを接続していましたが、もう少し柔軟で容易に推論資源を利用できるように、これ … 続きを読む
LLM Runtime Agent は、ZIKUU Mini 上で動作する LLM / AI 推論バックエンドの起動・停止・状態確認を統一的に扱うための小さなホスト常駐サービスを作りました。LLM Brokerの背後で動 … 続きを読む