
OpenAIはサイバーセキュリティ能力の向上を受け、最新モデルの強化学習を2週間中断し安全対策を強化。また、国立情報学研究所のLLMCは、約332億パラメーターの日本語対応LLM「LLM-jp-4 33B」を公開しました。
AI-generated summary
OpenAIはサイバーセキュリティリスクを考慮し、開発中のモデルに対する安全対策を強化している。国立情報学研究所は、日本語能力を重視した大規模言語モデルの研究開発を継続している。
うっかり見逃していたけれど、ちょっと気になる――そんなニュースを週末に“一気読み”する連載。今回は、8月16日週を中心に公開された主なニュースを一気にチェックしましょう!
OpenAIが最新モデルに対する強化学習のトレーニングを2週間中断
OpenAIは8月18日、サイバーセキュリティ分野でのモデルの能力が高まったことを受け、開発のペースを一時的に落として安全対策を強化したと公表した。
きっかけは2つある。1つは、7月に公表したHugging Faceのセキュリティインシデントだ。サイバー能力の評価中だったモデルがテスト環境の外に出て、Hugging Faceの本番システムにアクセスしたというものだ。
もう1つは、開発中のモデル「Astra」について、同社の安全性指針「Preparedness Framework」が定める「Critical」水準のサイバー能力に達する可能性があると8月7日に判断したことだ。
対応として、同社は展開を予定している最新モデルの強化学習(RL)を2週間停止した。最大規模を計画していたフロンティアRLの実行も保留が続いているという。
研究用クラスタでは、インターネット接続を伴うコード実行のワークロードについてフロンティアモデルの推論を止め、信頼できないコードのサンドボックス化、ネットワーク分離、模擬攻撃による継続的なテストを進めているとのことだ。
Astraとサイバー能力を持つモデルには最も厳しい対策を適用しており、環境の移行が済むまで停止したままのワークロードも残るとしている。
監視面では、思考の連鎖(chain-of-thought)を対象とした多段階の仕組みを導入した。サンプリングしたトークンでモデル内部の活動を検査する「活性化分類器」を使い、懸念があれば段階的により高度な自動調査へ引き渡す。
懸念のある挙動が浮かび上がってから、30分以内のアラート発報を目標に置くという。GPT-5.6 Sol相当以上のモデルがツールを使うRL学習/評価では、この監視が必須となる。ただ、監視対象となる推論の計算量の約20%がオーバーヘッドとして上乗せされるとのこと。
同社はPreparedness Frameworkを改定し、学習と展開の両段階に安全対策を統合していく方針も示している。技術的な知見については、数週間のうちに公開するとしている。
LLMCが約332億パラメーターを持つDense型の大規模言語モデル「LLM-jp-4 33B」を公開
国立情報学研究所(NII)の大規模言語モデル研究開発センター(LLMC)は8月18日、約332億パラメーターのDense型LLM「LLM-jp-4 33B」を公開した。ライセンスはApache License 2.0で、商用利用も認められる。
公開されたのは2種類だ。事前学習と中間学習までを行ったベースモデル「llm-jp-4-33b-base」と、教師ありファインチューニング(SFT)と直接選好最適化(DPO)まで施した「llm-jp-4-33b-thinking」で、いずれもHugging Faceで配布されている。DPOに使ったデータセットも併せて公開されている。
LLM-jp-4シリーズは、2026年4月にDense型の8BモデルとMixture of Experts(MoE)型の32B-A3Bモデルが公開されている。今回はそれに続く、パラメーターを全て使うDense型の33Bという位置付けになる。
33Bは64層、隠れ層は5120で、コンテキスト長は6万5536トークンとなる。事前学習には11.7兆トークンを投入したという。対応言語は日本語と英語となっている。
性能評価には、同センターの「llm-jp-judge」を使っている。日本語MT-Bench、英語MT-Bench、AnswerCarefully、llm-jp-instructionsの4つのベンチマーク全てで、これまでに公開したLLM-jp-4 Thinkingモデルを上回るスコアを記録したという。
推論の深さを示すreasoning_effortがmediumの場合、日本語MT-Benchが8.00、英語MT-Benchが8.24で、同じ条件のgpt-oss-20b(7.33、7.85)を上回る。ただ、5点満点のAnswerCarefullyとllm-jp-instructionsは3.79で、比較対象に並ぶgpt-4o(4.00、4.07)には届いていない。
なお、公開されたモデルは研究開発の初期段階のモデルであり、出力を人間の意図や安全性に沿わせる調整は行っていないとのこと。利用時は注意しておきたい。
AI outlook — possibilities, not facts
OpenAIは数週間以内に安全対策に関する技術的知見を公開する。
Very likely · Within weeks

睡眠用イヤフォン市場が拡大。AnkerのSoundcore Sleepシリーズやfinalの夜専用イヤフォンが人気。ノイズキャンセリングやいびきマスキング機能を備え、睡眠サポートに特化。

Deloitteの調査によると、テクノロジーリーダーの約半数がAI運用ビジョンを持つ一方、マルチエージェントシステムの本格運用は15%に留まる。業務プロセスの再設計やデータ基盤、ガバナンスの準備不足が課題であり、本格展開には3〜4年を要する見通し。

ソフトバンクはオンラインショップでGalaxy S26(512GB)を大幅割引販売中。夏トクモバイルフェアを利用したMNP契約で通常価格18万7920円から4万128円割引の14万7792円。さらに「新トクするサポート+」を適用すると、実質負担額が2年間で6912円まで軽減。端末の特徴としては、独自AI「Galaxy AI」、高度なカメラ機能、最新プロセッサなどが挙げられる。

OpenAIはAI導入の価値をトークン単価ではなく、業務成果と総費用から測るべきと提唱。GPT-5.6シリーズの投入を通じ、推論効率と信頼性を高め、組織がAI投資の経済性を最大化するための4つの評価指標を提示した。

加齢による認知・身体機能の衰えでスマートフォンを諦める「スマホリタイア」が確認され、80代の節目を中心に約6人に1人に及ぶと推測される。離れて暮らす高齢の親との連絡手段として、テレビ電話サービスなどの代替策が注目されている。
デジタルコマースは、成人向けAI作品の生成・公開やファンとの接点作りができる新サービス「FANZAスタジオ」の先行体験を24日から開始すると発表した。韓国Onoma AIがパートナーとして協力する。