技術2026年4月25日(土)SwiftLMで非Qwen系MoEのLing-flash-2.0 MXFP4をM1 Max 64GBで動かすAnt Group系列のinclusionAIが公開したLing-flash-2.0(bailing_moe、100B A6.1B、MXFP4量子化)をSwiftLMで食わせてみた記録。mlx-swift-lmのbailing_moe対応状況の確認から起動までを追う。Apple SiliconLLMMLXローカルLLMSwiftSwiftLMMoEMXFP4Ant Group実験
技術2026年4月24日(金)更新WAI-Illustrious v17を試す 手足補正・レーティング4段階・v16学習のLoRAは生き残るかWAI-Illustrious SDXL v17がリリースされた。目玉はhires fixの手足自動補正。M1 Max 64GBのComfyUIで同一seedでv16と比較し、general/sensitive/nsfw/explicitのレーティング4段階、NSFW発動条件、v16で学習したかなちゃんLoRA (04/05) の効き具合を見た。AI画像生成ComfyUIStable DiffusionLoRAApple Silicon実験
技術2026年4月24日(金)VercelがContext.ai起点と独立の先行侵害を4/23に確認、Lumma Stealer経由のVercelトークン直接窃取も想定Vercelが4/23に公開した続報で、Context.ai侵害とは独立した顧客アカウントの先行侵害を確認した。Lumma Stealerの感染経路、ShinyHuntersの$2M売却リスト、non-sensitive環境変数の実体まで含めて整理する。VercelセキュリティOAuthインシデントマルウェアサプライチェーン
技術2026年4月24日(金)更新Claude Codeの品質劣化とコスト圧力は同じ原因だったAnthropicのpostmortemとDEVの実運用観測を同じ週に読むと、Claude Codeの品質劣化とMax週次枠枯渇は別トラブルに見えて、同じ『品質×コスト』の設計判断から生まれている。時系列と運用優先順位を重ねて整理する。Claude CodeAnthropicAIエージェント品質クォータPrompt Caching
技術2026年4月24日(金)SwiftLMをM1 Max 64GBで動かしてOllama/MLX-lmと比べてみたSwift製LLM推論サーバーSwiftLMをM1 Max 64GBで実際にビルド・起動して、Qwen3.6-35B-A3Bと122B-A10Bの挙動を確認。BST・簡易BBS・かなちゃんペルソナの3系統で既存のOllama・MLX-lm検証と突き合わせた。Apple SiliconLLMMLXローカルLLMSwiftSwiftLMMoE実験
技術2026年4月24日(金)TRACERはLLM分類APIのログから代理モデルを学習してparity gateで置き換えるarXivに出たTRACERは、LLM分類エンドポイントの入出力ログをそのまま訓練データに転用し、parity gateで合格した領域だけ軽量な代理モデルに差し替えて推論コストを下げる仕組みだ。77クラスの意図分類で83〜100%、150クラスでは100%のトラフィックを代理モデルが吸収できることを示した一方、NLIタスクでは「配備不可」と正しく拒否した挙動が面白い。AILLM機械学習論文推論最適化
技術2026年4月24日(金)デジタル庁がガバメントAI「源内」をオープンソース化、RAG・LLMセルフデプロイ・法制度AIのテンプレートを商用利用可で公開デジタル庁が中央省庁で展開中の生成AI利用環境「源内」を、MIT / CC BY 4.0でGitHubに公開した。Webアプリ本体と、AWS・Azure・Google Cloudそれぞれのクラウド向けAI開発テンプレートがセットで公開されており、地方自治体や民間でも再利用できる。AILLMRAGオープンソース国策AWSAzureGoogle Cloud
技術2026年4月24日(金)DeepSeek V4 Previewが1Mコンテキストで登場、V4-Pro 1.6T/V4-Flash 284BがMITで公開されV3.2比27% FLOPsを実現DeepSeekが2026年4月24日にV4 Previewを公開。V4-Pro(1.6T/49B active)とV4-Flash(284B/13B active)はどちらも1Mコンテキストに対応し、CSA+HCAハイブリッドアテンションとmHC、Muonオプティマイザで1Mトークン時のFLOPsをV3.2比27%まで削減している。Expert Mode / Instant Modeとして即日APIも更新された。LLMDeepSeek中華系AIMoEオープンモデルAIエージェント
技術2026年4月24日(金)更新Tencent Hy3-previewとAnt Ling-2.6-flashが同週公開、中華系オープンMoEが295Bと104Bで別方向に走る2026年4月22日にAnt LingがLing-2.6-flash(104B/7.4B active)を、翌23日にTencent HunyuanがHy3-preview(295B/21B active)をそれぞれオープンウェイトで公開した。片やDeepSeek-V3やGLM-4.5と同じフロンティア帯を狙う重量級、片やトークン効率7倍を打ち出す高効率エージェント特化型で、同じ週に出てきた中華系MoEでも方向性がはっきり分かれている。LLM中華系AIMoEオープンモデルAIエージェントローカルLLMOpenRouter
技術2026年4月23日(木)更新Xiaomi MiMo-V2.5とV2.5-Pro同時公開、1Mオムニモーダルと1000ツール呼び出しエージェントをAPI先行で提供XiaomiがMiMo-V2.5系列を2モデル同時公開。MiMo-V2.5-ProはSWE-bench Pro 57.2、Claw-Eval 63.8、τ3-Bench 72.9でフロンティア級、MiMo-V2.5はネイティブオムニモーダル+1M context。現時点ではAPI専用でローカル実行は不可、オープン化は予告のみ。AILLM中華系AIMoEAIエージェントマルチモーダルXiaomi
技術2026年4月23日(木)更新NVIDIA NIMが100モデル超のホスト推論を無料公開、OpenAI互換でOpenClawやCursorから直接叩けるNVIDIAがbuild.nvidia.comで提供する無料推論API「NIM」は、MiniMax M2.7やGLM-5、Kimi K2.5、DeepSeek、GPT-OSS、Sarvam-Mなど100モデル超を扱える。integrate.api.nvidia.com/v1のOpenAI互換エンドポイントなのでOpenClawやOpenCode、Zed、Cursorから直接呼べる。NVIDIALLMAPIOpenAIAI CodingOpenClaw
技術2026年4月23日(木)open-notebookをDockerもクラウドAPIも使わずM1 Maxで動かしてqwen3.6:35bに自分の記事を読ませたNotebookLMクローンのopen-notebookはデフォルトがDocker前提+クラウドAPI前提。SurrealDBをネイティブで入れて4プロセスをtmuxで立ち上げ、Ollamaのqwen3.6:35bとbge-m3だけでRAGを回した。自分が今朝書いたQwen3.6比較記事を食わせたら、正しい数値で答えた。AILLMローカルLLMOllamaQwenApple SiliconRAGOSS実験