世界を動かす技術を、日本語で。

Z.aiが「Ox Alpha」が新しいGLMシリーズモデルであることを確認し、その重みを公開する予定です。

2026年8月26日原文(bloomberg.com)

概要

  • JavaScriptとCookieのサポートが必要
  • ブラウザ設定や拡張機能が影響する場合あり
  • 利用規約やCookieポリシーの確認が推奨される
  • 問題解決のための基本的な対策を紹介
  • セキュリティとプライバシーの注意点も解説

ブラウザでのJavaScriptとCookieの有効化

  • JavaScriptCookie は多くのウェブサイトで必須機能
  • ブラウザ設定から JavaScriptの有効化 が必要
  • Cookieの受け入れ設定も プライバシー設定 で管理
  • 拡張機能やアドブロッカーが JavaScriptやCookieの読み込みを妨げる 場合あり
  • サイト利用時は ブラウザの最新バージョン 推奨

利用規約とCookieポリシーの確認

  • Terms of Service (利用規約)にはサービス利用条件を記載
  • Cookie Policy (Cookieポリシー)でデータ収集や利用方法を説明
  • サイト利用前に 両方のポリシーを確認 することが重要
  • 不明点や懸念がある場合は サポート窓口への問い合わせ を推奨

問題解決のための基本対策

  • ブラウザ設定の見直し (JavaScript・Cookieの有効化)
  • 拡張機能の一時無効化 で動作確認
  • キャッシュとCookieのクリア による不具合解消
  • 別の ブラウザやデバイスでの再試行 も有効
  • セキュリティソフトによる 通信制限の確認

セキュリティとプライバシーへの配慮

  • JavaScriptやCookieの有効化は 利便性と引き換えにリスク も存在
  • 個人情報の取り扱いに関する プライバシーポリシーの確認 が重要
  • 不審なサイトでは JavaScriptやCookieの制限 を検討
  • セキュリティ対策ソフトの 警告や通知にも注意

Hackerたちの意見

残念ながら、今のところこれ以外の情報は見つからないけど、これが本物っぽいね。

水曜日に、会社はOx AlphaモデルがGLMシリーズの新しいバージョンであるという噂を確認し、Bloomberg Newsの問い合わせに応じて今夜その重みを発表すると言った。信じられそうだね。本当にどれだけ良いのか分かりにくいけど、周りはすごい盛り上がってる。

彼らは公式に確認したね。

公開テスト中にどうなってたのか気になるな。テストの初期と比べて、後半ではかなりタスクのパフォーマンスが改善されたって報告がたくさんあったから。

笑、明らかなことを大声で言わないでよ。

私の視点から見ると、2つの可能性があるかな。1. pass@Kのばらつき。どのモデルでも何度もプロンプトを与えると大きなばらつきが見られるよ。N=1だけど、中国のオープンソースモデルはFableやOpusのような高RLモデルよりもばらつきが大きい気がする。2. 本当に7日間で新しいRLチェックポイントを出したってこと。これは信じがたいな。私は1の方に傾いてる。

最初にモデルのベストバージョン(クオンタム)を提供するのは理にかなってる。そうすればユーザーはずっとテストし続けるからね。モデルの開発者が、モデルの能力を徐々に落としながらいろんなクオンタムレベルを試そうとしたのも納得できる。

混乱してるな。ここではGPT-5.4 Nanoよりもパフォーマンスが低いのに、ここではFableをかなり上回ってる: https://livebench.ai/ でも、もし後者が本当なら、みんなはまだ「Fableから抽出された」って言うのかな?

2つ目のウェブサイトは公式じゃなくて、誰かが何かの理由で適当に作ったものだよ。

GLM 5.3は素晴らしいモデルだったから、退化したモデルをリリースするのは変だね。

outperform Fableは中途半端な(未完成の)ベンチマークテストだった。実際の結果はもっと低かったよ。

あのベンチマークはめっちゃ怪しい。誰かが指摘するまで、最高のパフォーマンスを出してたオープンウェイトモデルは、スポンサーのKimi K3のファインチューニングだった(abacusai/Smaug-Agentic)。今はリストに載ってないけど。出典: https://twitterwebviewer.com/?tweet=2091116504787935350

Hacker Newsで議論の続きを見る