4分
Meta の Muse Voice Transcribe が 20 人を聞き分ける——録音は素材でなくなるが、手元では動かない
話しながら文字になり、20 人を超える話者が分かれる。録音は「あとで聞き返す素材」から読める記録に変わる。ただし手元だけで動かす選択肢はなく、話者分離の誤り率は 17.5% と公表されている。
INDEX · KEYWORD
「パーソナルAI」に関連する公開記事をまとめています。
話しながら文字になり、20 人を超える話者が分かれる。録音は「あとで聞き返す素材」から読める記録に変わる。ただし手元だけで動かす選択肢はなく、話者分離の誤り率は 17.5% と公表されている。
テキスト・画像・動画・3D を一つのモデルにした Atlas が公開された。変わるのは画質ではなく、撮った記録に後から入り直せるかどうかだ。ただし早期アクセスの相手も価格も未公表で、今日触れるのは別モデルのほうになる。
48時間と GPU 1枚で、Claude は10種類の欠陥すべてに改善策を見つけた。ただし直せたのは、あらかじめ点数のつく失敗だけだ。測る道具のない失敗は、直っていないのではなく数えられていない。
AI に「どのモデルに聞くか」を尋ねられる場面は減った。裏側で選んでいる層が、決済の会社に渡ろうとしている。その選び方は、実は自分の側から確かめられる。
ChatGPT のデスクトップ版に、アプリやウェブサイトをまたいだ操作を記憶する Computer History が入った。既定はオフで、有効にするかは自分で選ぶ。何を渡し、何が返ってくるのかを、押す前に見ておきたい。
OpenAIが公開前のモデルAstraを、自社の枠組みで初めて「critical」として扱うと発表した。そのうえで、絞り込まずに広く配るとも言っている。守る側に強い道具が渡るという理屈は、一人の手元では何になるのか。