タグ一覧

#LLM

150 件の記事

GPT-OSSの隠れ状態を記号構造の式に差し替えても答えがほぼ同じだった論文
技術

GPT-OSSの隠れ状態を記号構造の式に差し替えても答えがほぼ同じだった論文

「LLMに感情や自我の自覚を与えると性能が出る」と紹介された論文を読んでみた
技術

「LLMに感情や自我の自覚を与えると性能が出る」と紹介された論文を読んでみた

125BのQwen3.8-Flash-NextをEVO-X2のROCmで動かす
技術

125BのQwen3.8-Flash-NextをEVO-X2のROCmで動かす

125BのQwen3.8-Flash-NextをM1 Max 64GBで動かせるか
技術更新

125BのQwen3.8-Flash-NextをM1 Max 64GBで動かせるか

Anima-2.9Bと同じ層拡張をQwen3-0.6Bでやったら、新層だけで自分の記事は覚えたが、元の層を凍結しても忘れた
技術

Anima-2.9Bと同じ層拡張をQwen3-0.6Bでやったら、新層だけで自分の記事は覚えたが、元の層を凍結しても忘れた

Geminiが「I am a disgrace」と86回繰り返した自己嫌悪バグのその後を調べた
技術

Geminiが「I am a disgrace」と86回繰り返した自己嫌悪バグのその後を調べた

Kimi K3の896エキスパートを「896人の専門家」と呼ぶと何がズレるか、ルーターは何を選んでいるのか
技術

Kimi K3の896エキスパートを「896人の専門家」と呼ぶと何がズレるか、ルーターは何を選んでいるのか

Qwenはchat.completionsのenable_searchでも検索したが、参照したURLはResponses APIでないと取れなかった
技術

Qwenはchat.completionsのenable_searchでも検索したが、参照したURLはResponses APIでないと取れなかった