4月末からVLM構築を始めて3か月、データ数は今の所12Mメッシュで、まだ完了してない。元データの規模は1000TB=1PB!その中から3Dデータとそれに紐づくテクスチャやマテリアルデータを抽出(約50TB)してから、AI学習用メッシュに変換し、VLMを構築する流れです。メッシュ作成の遅さはマシンの遅さで、しょうがないです。当初、空いているマシン5台で回していたが内3台は10年位古いPCで最近のと10倍スピードが違うので2台がメインで処理してます。次なるボトルネックはHDDの速さでSATAにしてReadとWriteを別にしたり、SSDのドライブをワークにしたりとAIと一緒に実測しながら変換方法を決めていた感じでした。ソフト的な問題はAutodeskのコンバータがひどすぎて、ゾンビプロセスを量産するは、メモリを直ぐオーバーフローさせるはで、何度もマシンが過熱してシャットダウンさせられ、えらい目にあわされました。加えてGeminiの仕業が「メッシュを認識=チェック=変換は時間がかかるので次のデータに移る」を繰り返して、「○○万件終了」と1カ月半報告し続けていたのは、ぶっ飛びました。報告をうのみにしていて、ある時、何十万件の処理報告と実際のデータの増え方が余りにも違うので、別なAIエージェントや他社のモデルにチェックさせたらバレて大騒ぎでした。現在は9割ほど変換が終わり並行してAI学習を開始!まだ7万ぐらいですが、すでに1エポック2日かかり始めた。これから、過学習を避けても1Mはありそうなのにゴールが何処まで遠いのか心配です。まだ、学習したモデルは都度Polyductionに反映させてるのが、唯一の救いです。
Polyduction用VLMを構築中。
未分類
コメント