Qwen3.8-Max-0902 で上がったのは借りる側だけだった——同じ2.4兆でも、落とせる重みは8月のまま
Qwen の最上位が更新されたが、告知が出たのは API で借りる側だけだった。8月に配布された同じ2.4兆パラメータの重みとは、文脈長もライセンスも扱えるものも違う。
INDEX · KEYWORD
「ローカルAI」に関連する公開記事をまとめています。
Qwen の最上位が更新されたが、告知が出たのは API で借りる側だけだった。8月に配布された同じ2.4兆パラメータの重みとは、文脈長もライセンスも扱えるものも違う。
129億ドルでの買収合意が報じられた。両社はまだ何も認めていない。個人がモデルを落としてくる既定の行き先が、GPU を作る会社のものになるかもしれない。
モデルの重みは凍結したまま、外側の記憶だけを書き換え続ける仕組みが公開された。著者らの計測では 37 組中 35 組で成功率が上がり、育てた記憶は別のモデルにも移ったという。手元で試すのに要るものと、まだ分からないコストを整理する。
手元に置ける大きさのモデルに、上位帯に見える数字が付いた。ただしその52は英語のテキストで測られていて、このモデルの目も、日本語も、まだ数字の外にある。
Anthropic の Amodei が、めったに書かない長文をXに投げた。要旨は「重みを公開しても集中は解けず、計算資源とチップを持つ側へ移るだけだ」。禁止の話ではない。ただ、手元で動かせるモデルの上限をどこに引くかという線は、確実に議論の中心に来ている。
Qwenが最上位クラスのモデルの重みを初めて公開した。ただし開いたのはテキスト専用版で、ライセンスも標準のオープンソース形ではない。個人にとっての意味は「自分で動かす」より先に、別のところにある。
Metaが30BのMuse GlimmerをApache 2.0で公開した。GPU1枚で動くと言うが、フル精度なら55GB超、圧縮しても24〜32GBの枠が要る。手元に置くことで何が買え、何は買えないのかを値段ごと見る。