Son Dakika
ARإسقاط مسيرات أوكرانية فوق عدة مناطق روسية واستهداف مستودع في فلاديميرINभारतीय कुश्ती महासंघ के पूर्व अध्यक्ष बृज भूषण शरण सिंह महिला पहलवानों के यौन उत्पीड़न मामले में बरीUSWildfires Force 60,000 Evacuations, Destroy 600 Structures in Eastern WashingtonINOver 200 Civil War Cannonballs Discovered on Mississippi PropertyTRMeteoroloji'den Sağanak Yağış ve Kuvvetli Rüzgar UyarısıESLa UE busca una generación sin humo para 2040 con subida de impuestos al tabacoTRNew York Times: Trump'ın İran politikasında kontrolü kaybetmesi daha büyük bir tehlike yaratıyorCN2026年全国“村BA”广东省赛云浮云安开幕 23支乡村队角逐晋级资格AUQueensland government considers allowing police to collect child DNA without court orderTRKolombiya Cumhurbaşkanı Petro'dan Netanyahu'ya sert suçlamalarARإسقاط مسيرات أوكرانية فوق عدة مناطق روسية واستهداف مستودع في فلاديميرINभारतीय कुश्ती महासंघ के पूर्व अध्यक्ष बृज भूषण शरण सिंह महिला पहलवानों के यौन उत्पीड़न मामले में बरीUSWildfires Force 60,000 Evacuations, Destroy 600 Structures in Eastern WashingtonINOver 200 Civil War Cannonballs Discovered on Mississippi PropertyTRMeteoroloji'den Sağanak Yağış ve Kuvvetli Rüzgar UyarısıESLa UE busca una generación sin humo para 2040 con subida de impuestos al tabacoTRNew York Times: Trump'ın İran politikasında kontrolü kaybetmesi daha büyük bir tehlike yaratıyorCN2026年全国“村BA”广东省赛云浮云安开幕 23支乡村队角逐晋级资格AUQueensland government considers allowing police to collect child DNA without court orderTRKolombiya Cumhurbaşkanı Petro'dan Netanyahu'ya sert suçlamalar
Newsgather
GeriOpenAI、GPT-5.6 Sol、Terra、Lunaを発表 - サイバーセキュリティとコーディング能力を強化
OpenAI、GPT-5.6 Sol、Terra、Lunaを発表 - サイバーセキュリティとコーディング能力を強化
Gelişiyor
ITmedia01.07.2026Teknoloji6 dk okumaJapan

OpenAI、GPT-5.6 Sol、Terra、Lunaを発表 - サイバーセキュリティとコーディング能力を強化

Hızlı Bakış

OpenAIは、サイバーセキュリティとコーディング能力を強化したGPT-5.6 Sol、Terra、Lunaを発表。政府との連携や、モデルの安全性と能力向上に焦点を当てている。価格設定や今後の提供計画も明らかにされた。

Yapay zekâ özeti

Yazı boyutu

今回の限定プレビューは、米政府との継続的な協議が背景にある。OpenAIは発表前に、計画とモデルの能力を米政府に共有した。政府側の要請を受け、参加者情報が政府に共有された少数の信頼できるパートナーから提供を始める。OpenAIは、この種の政府アクセス手続きが長期的な標準になるべきではないとの考えを示しつつ、今後数週間で幅広い提供に移るための短期的措置と説明した。加えて、サイバー関連の大統領令フレームワークに即しつつ、今後のモデル公開に使える再現性ある手続きを政権側と作る考えも示した。

性能面では、GPT-5.6 Solを同社の現時点で最上位のモデルと位置付ける。評価については、コーディングや生物学、サイバーセキュリティの分野で、エージェンティックな能力の向上を示した。詳細な安全性と準備状況の評価はシステムカードで公開し、一般提供時には評価結果の拡充版を出す予定だ。GPT-5.6では、新たに最大推論努力設定を導入し、Solが深い推論に時間を使えるようにした。単一エージェントの能力を超える「ultra mode」も導入し、サブエージェントを活用して複雑な作業を速める。

GPT-5.6 Solはコーディング領域において、Terminal-Bench 2.1で最先端の水準を示した。同ベンチマークは、計画、反復、ツール連携を要するコマンドライン作業を測るものだ。サイバーセキュリティ領域においては、脆弱(ぜいじゃく)性研究やエクスプロイトを含む長期的なセキュリティ作業で、性能と効率の境界を押し上げた。脆弱性をどこまで悪用できるかを測るベンチマーク「ExploitBench」では、Mythos Previewに近い性能を約3分の1の出力トークンで実現した。UC Berkeleyの研究者がOpenAIなどと協力して作ったエクスプロイト能力を評価する「ExploitGym」でも、推論量の増加に伴いSol、Terra、Lunaの各モデルがサイバー能力を高めた。

安全対策について、OpenAIはGPT-5.6 Sol、Terra、Lunaに過去最も堅牢(けんろう)な保護策を導入したと説明した。各モデルの能力に応じて設定を変え、実世界の敵対的圧力に耐える設計を目指した。正当なコードレビュー、脆弱性研究、パッチ開発、デバッグ、セキュリティ教育、防御的テストへのアクセスを保ちながら、禁止される攻撃的活動をより困難で、不確実で、検知可能にすることを目標に掲げる。OpenAIの評価では、正当な防御作業には大きな利益が見込まれ、禁止される攻撃的利用は意味のある形で制約される。

GPT-5.6 Solは、脆弱性の発見・修正支援で高い能力を持つが、エンド・ツー・エンドの攻撃を安定して実行する段階には至らないとOpenAIは説明した。同社が独自に定めるリスク評価基準「Preparedness Framework」上では、最高警戒レベルに当たる「Cyber Critical」のしきい値を超えていないという。「Chromium」と「Mozilla Firefox」による評価において、バグやエクスプロイトの構成要素は見つけたが、テスト条件下で機能するフルチェーンエクスプロイトを自律的には生成しなかった。ただし、ベンチマークの評価基準だけでは、モデルが他のツールと組み合わされる場合を含む全利用形態を捕捉しきれない。OpenAIは、この不確実性と能力の段階的変化を踏まえ、保護策と段階的公開を組み合わせる。

保護策は複数層で構成する。モデル自体には、禁止されたサイバー支援を拒否する訓練を施した。ユーザーが意図を隠した場合や脱獄を試みた場合も対象になる。生成中にはサイバーと生物学の不正利用分類器が出力を評価し、高リスクの場合は生成を止め、大型推論モデルが会話と文脈を確認する。許可されない出力と判断された場合、ユーザーに届く前に差し止める。フラグが立った活動は、利用規約やポリシーに沿って、関連会話やリスクシグナルを含むアカウント単位の確認につながる場合がある。

プレビュー中は、正当な作業でも拒否やブロックが発生する可能性がある。特に防御的活動と攻撃的活動が初期段階で似て見えるデュアルユース領域では、保護策が作業を止める場合がある。OpenAIは、プレビューを通じて、悪用を抑えつつ通常業務を安定して効率よく完了できるかを確認する。企業顧客とは、プライバシーを保つ検知、顧客側が運用する安全管理、顧客・ユーザー・ワークロードのリスクに応じたアクセス管理など、長期的な方策も探る。

堅牢性強化において、自社モデルを使った自動レッドチーミングに70万A100相当GPU時間超を投じた。狙いは、多様なプロンプトや文脈で効く汎用(はんよう)的な脱獄手法を見つけ、保護策を早く改善することだ。人間の専門家による第三者レッドチーミングも実施し、プレビュー期間中も継続する。OpenAIは、評価だけでは全ての製品構成や複数段階の攻撃、実世界の作業を代表できないとしている。そのため、新たに見つかった脱獄を再現や評価、優先付け、修正し、継続評価に組み込む迅速対応プロセスを維持する。

価格は100万トークン当たりで、Solが入力5ドル、出力30ドル、Terraが入力2.50ドル、出力15ドル、Lunaが入力1ドル、出力6ドルだ。GPT-5.6以降では、より予測可能なプロンプトキャッシュも導入する。明示的なキャッシュ区切りと30分の最小キャッシュ保持期間をサポートし、キャッシュ書き込みは非キャッシュ入力料金の1.25倍、キャッシュ読み取りは90%割引を継続する。2026年7月中に、Cerebras上でGPT-5.6 Solを最大毎秒750トークンで提供する計画も示した。初期アクセスは、容量拡大に沿って一部顧客に限定する。

İlgili Konular

Bu haber ilk olarak şurada yayınlandı: ITmedia.

İlgili Haberler

セールスフォース・ジャパン、AIエージェントで顧客対応431万件を自律完結し営業商談数を4~5割増に
Teknoloji·7 saat önce

セールスフォース・ジャパン、AIエージェントで顧客対応431万件を自律完結し営業商談数を4~5割増に

セールスフォース・ジャパンは、AIエージェント導入の課題に対し、自社実践「カスタマーゼロ」を通じて累計431万件の顧客対応を自律完結させ、営業商談数を4~5割増に成功。田中遼太COOが、成果を出すAIエージェントの運用方法やCRM連携による対話力強化について語った。

ITmedia
4 dk okuma
Bu konuda daha fazlaOpenAI