技術2026年5月2日(土)FastAPI・Chroma・Open WebUI・Ollamaでマルチモーダル日本語RAGをM1 Maxで組んだDEV記事のPDF RAGをM1 Max 64GBで実装し、CLIPで画像、bge-m3 + Qwen3.6 35Bで日本語まで通した実験ログ。モダリティギャップ、推論サーバー並走クラッシュ、LLM-jp 4-8Bの指示追従失敗まで実機の挙動を記録。AILLMRAGローカルLLMFastAPIllama.cppChromaPythonApple SiliconOllama日本語LLM実験
技術2026年5月2日(土)Qwen-ScopeのSAEをM1 Max 64GBで動かして日本語特徴を取り出すQwen-ScopeのSparse AutoencoderをローカルのM1 Max 64GBで動かし、Qwen3-8B-Baseの中間層から日本語・英語・コード・中国語を弁別する特徴IDを取り出した記録。AILLMQwen解釈可能性実験Apple SiliconMPS
技術2026年4月30日(木)更新mflux vs iris.cでFLUX.2 Klein 4Bを動かしたM1 MaxベンチFLUX.2 Klein 4BをM1 Max 64GB上で、mflux(MLX)とiris.c(純C+Metal)の2系統で実機ベンチ。Pruna AIのH100前提チュートリアルへのカウンターとして、Apple Siliconで何秒で出るかを実測した。AI画像生成FLUXApple SiliconMacMLX実験
技術2026年4月30日(木)Xiaomi MiMo-V2.5はMacやROCmで動かせるのかXiaomi MiMo-V2.5のウェイト公開後、Mac/ROCmとクラウドGPU(RunPod/GCE)での実行可否を調べた。手元機ではまだ厳しいが、RunPodの4x H200で約14ドル/時間、GCE SpotのH100なら約1.6ドル/時間で動かせる。AILLMローカルLLMXiaomiMoEApple SiliconROCmllama.cpp
技術2026年4月29日(水)更新Z-AnimeはZ-Image系のアニメ特化フルファインチューンだったSeeSee21/Z-AnimeがZ-Image Baseのフルファインチューンであることを確認し、AIO版をM1 Max 64GBのローカルComfyUIで動かしてt2i・i2i・NSFW通り具合まで検証した。AI画像生成Z-ImageComfyUIApple Silicon実験
技術2026年4月29日(水)AIイラストを漫画モノクロに変換するときグレスケではなくスクリーントーンにしたい話カラーのアニメ系AIイラストを漫画原稿風のモノクロへ変換する検証ログ。AI再生成系は色残りか顔変化のどちらかに寄り、決定論的なローカル処理だけだと機械的に見える。次に試すべき方向(Anima にグレスケ専用LoRAを載せる案、See-throughで部位分離してから機械合成する案)まで整理する。AI画像生成ComfyUILoRA漫画スクリーントーン実験Apple SiliconSDXLQwenZ-ImageAnima
技術2026年4月25日(土)SwiftLMで非Qwen系MoEのLing-flash-2.0 MXFP4をM1 Max 64GBで動かすAnt Group系列のinclusionAIが公開したLing-flash-2.0(bailing_moe、100B A6.1B、MXFP4量子化)をSwiftLMで食わせてみた記録。mlx-swift-lmのbailing_moe対応状況の確認から起動までを追う。Apple SiliconLLMMLXローカルLLMSwiftSwiftLMMoEMXFP4Ant Group実験
技術2026年4月24日(金)更新WAI-Illustrious v17を試す 手足補正・レーティング4段階・v16学習のLoRAは生き残るかWAI-Illustrious SDXL v17がリリースされた。目玉はhires fixの手足自動補正。M1 Max 64GBのComfyUIで同一seedでv16と比較し、general/sensitive/nsfw/explicitのレーティング4段階、NSFW発動条件、v16で学習したかなちゃんLoRA (04/05) の効き具合を見た。AI画像生成ComfyUIStable DiffusionLoRAApple Silicon実験
技術2026年4月24日(金)SwiftLMをM1 Max 64GBで動かしてOllama/MLX-lmと比べてみたSwift製LLM推論サーバーSwiftLMをM1 Max 64GBで実際にビルド・起動して、Qwen3.6-35B-A3Bと122B-A10Bの挙動を確認。BST・簡易BBS・かなちゃんペルソナの3系統で既存のOllama・MLX-lm検証と突き合わせた。Apple SiliconLLMMLXローカルLLMSwiftSwiftLMMoE実験
技術2026年4月23日(木)open-notebookをDockerもクラウドAPIも使わずM1 Maxで動かしてqwen3.6:35bに自分の記事を読ませたNotebookLMクローンのopen-notebookはデフォルトがDocker前提+クラウドAPI前提。SurrealDBをネイティブで入れて4プロセスをtmuxで立ち上げ、Ollamaのqwen3.6:35bとbge-m3だけでRAGを回した。自分が今朝書いたQwen3.6比較記事を食わせたら、正しい数値で答えた。AILLMローカルLLMOllamaQwenApple SiliconRAGOSS実験
技術2026年4月23日(木)更新Qwen3.6-27B DenseとQwen3.6-35B-A3B MoEをM1 Maxで比べたらMLXがOllamaの2倍速だったQwen3.6-27BをOllama/MLX両方で試したらOllamaはVLプロジェクタ付きGGUFをロードできず、MLXでは11 tok/sで動いた。ついでに35B-A3BをMLXで動かしたらOllama GGUFの2倍速。BBSを両モデルに作らせて意図汲み取りの差も見た。LLMローカルLLMQwenOllamaMLXApple SiliconMoE実験
技術2026年4月21日(火)更新Qwen3.6-35B-A3BをOllamaでM1 Max 64GBに流したら思考が13倍に膨らんだOllama 0.20.6でQwen3.6-35B-A3Bを試した記録。Gated DeltaNet対応済みで生成速度はQwen3.5と同じ27 tok/s、ただし思考トークンは13倍。マルチターン・ペルソナ・NSFW三段階の挙動もまとめた。LLMローカルLLMQwenOllamaApple SiliconMoE実験