技術2026年8月3日(月)Anima LoRA学習をMacのMPSで動かせた記録M1 Max 64GBのMacでAnimaLoraToolkit + Anima-BaseのLoRA学習を試した。torch2.6.0ではMPSのSDPA実装が既知のPyTorchバグでクラッシュしたが、torch2.7.1に上げるとステップが最後まで進みLoRA保存・画像生成まで通った。SDXL(kohya-ss)で13回全敗した過去のMac検証との対比も書く。LoRAAI画像生成AnimaAnima-BaseApple SiliconMPSPyTorch実験
技術2026年6月26日(金)Radeon 8060S(EVO-X2 / ROCm)でFastWanとWan 14Bを実走 ZLUDAは諦めてTheRockのgfx1151ホイールで動かしたAMD Radeon 8060S(EVO-X2 / Strix Halo / 48GB UMA)でローカルWan動画生成を実走。ZLUDAは公式PyTorchと非互換で全滅し、AMD TheRockのgfx1151ホイールでネイティブROCmが動いた。FastWan 1.3Bは4分、Wan 14B I2Vは13.6分、ボトルネックはVAEデコードと16GB RAMのSegfault。AI動画生成WanROCmAMDPyTorch実験
技術2026年4月21日(火)TRELLIS.2をM1 Max 64GBで動かしてみた検証ログCUDAフリー移植のTRELLIS.2(trellis-mac)をM1 Max 64GB環境で実際に動かし、セットアップ・生成時間・出力品質・ボトルネックを記録する検証記事。AppleSiliconMPSPyTorch3DML実験
技術2026年4月20日(月)更新TRELLIS.2をApple SiliconのMPSで動かすCUDAフリー移植CUDA専用ライブラリに依存するMicrosoftのTRELLIS.2(4Bパラメータ image-to-3D)をpure-PyTorchで代替実装し、M4 ProでNVIDIA GPUなしの動作を実現した移植の技術詳細。AppleSiliconMPSPyTorch3DローカルLLMML
技術2026年4月16日(木)AMD ROCmのCUDA追い上げはどこまで来たかEE TimesのAMD AI Software VP Anush Elangovan氏インタビューをベースに、ROCmとCUDAのエコシステム差を整理。Strix HaloでROCmを使い続けて4回壊れた実体験と、NVIDIA・AMD・Apple Siliconの実務での使い分けも。AMDNVIDIAROCmCUDAGPUAIインフラPyTorchMLXApple Silicon
技術2026年3月26日(木)ComfyUIアプデ後にQwen Image Editが10分かかるようになった原因を特定したMPSのBF16演算がFP16の2倍遅い問題と、FP16 Attentionバグが重なって発生した速度劣化の原因と対策ComfyUIQwenApple SiliconMPSPyTorch実験
技術2026年2月13日(金)更新ComfyUIのUpscaleがMac MPSで壊れる問題をcontiguousで直したLoad Image経由のUpscaleで画像が崩壊する問題を、テンソルのnon-contiguous対策で修正した記録。2026-04-29にComfyUI更新で上書きされて再発したのでPyTorch側の上流issueと再発の経緯も追記。ComfyUIApple SiliconPyTorchMPS実験