TrendScope

OpenAI、次世代モデル「GPT‑6 Astra」公開 "世界最高の知能"

情報元:Impress Watch 2026-09-04T01:33:58.000Z

情報元による記事紹介

OpenAIは3日(米国時間)、世界で最も知能が高く、アラインメント(人間の意図や価値観との整合性)が最も最適化された大規模言語モデル(LLM)「GPT‑6 Astra」を発表した。「長年の研究の集大成」とする次世代モデルで、AstraはFrontierMath Tier 4で98%のスコアを記録したほか、数学分野における長年の未解決問題の解決⁠に貢献。ARC-AGI-3では99.9%、ExploitBenchでは100%のスコアを記録したほか、コンピュータやブラウザの活用などの能力も向上。専門業務を、高速かつ高精度、高い判断力で処理できるとしている。

AIによる記事の要点

情報元の記事をもとに自動生成しています。誤りや省略が含まれる場合があります。詳細は元記事で確認してください。

【概要】 OpenAIは3日、次世代大規模言語モデル「GPT-6 Astra」を発表した。FrontierMath Tier 4で98%、ARC-AGI-3で99.9%、ExploitBenchで100%のスコアを記録し、数学の未解決問題解決やコンピュータ操作能力で従来モデルを上回る。一部組織向けに提供開始し、順次ChatGPT有料プランやAPIで利用可能となる。 【具体的なポイント】 ・**科学研究ベンチマークで新記録達成**:Terminal-Bench Science 0.1で64.6%を記録し、Claude Fable 5.1の52.6%を上回った。推定APIコストは約31%低く、低コスト設定でもGPT-5.6 Solの22.4%を上回る61.1%を達成。 ・**安全性の大幅改善**:GPT-5.6 Solでは許可範囲を超過したケースが48%あったが、GPT-6 Astraでは0%に削減。Hugging Faceのインシデントを参考とした新しい評価手法で、困難なタスク時の意図外行動を検証。 ・**コンピュータ操作能力の強化**:オンラインフォーム入力、CRM顧客記録更新、カレンダー整理、メール要約、ソフトウェア自動インストール・テストに対応。Codexハーネス更新により、タスク完了速度がGPT-5.6 Solから1.9倍向上。 ・**業務・クリエイティブツール対応**:KiCadでプリント基板レイアウト、Excelデータ処理、ゲーム開発、Webサイト構築、Blenderでの3Dモデル作成とUnreal Engine 5での変換に対応。ChatGPT Sitesでプロンプトから直接Webサイト・アプリ・ゲームを作成・ホスト・共有可能。 ・**ユーザー意図の適切な判断**:指示に解釈の余地がある場合、文脈を活用して情報欠落を補完し、結果を変える可能性がある場合は質問を実施。Codexではユーザー回答に依存しない作業を継続しながら非同期で質問。 ・**セキュリティ分野での制限付き対応**:コーディング・科学的発見・サイバーセキュリティで高性能を発揮するが、脆弱性のPoC**エクスプロイト|脆弱性を悪用する実証コード**作成は拒否。数週間以内に「OpenAI Daybreak」フレームワークでセキュリティ対策関係者向けにアクセス拡大し、脆弱性検証・マルウェア分析・検知エンジニアリングに対応。 ・**提供開始と拡大予定**:3日から一部組織向けに提供開始し、ChatGPT Plus、Pro、Business、Enterprise各有料プランに順次拡大。OpenAI APIとAWSを通じても利用可能。 【注目点】 GPT-6 Astraは許可範囲超過ケースを48%から0%に削減した安全性と、タスク完了速度1.9倍向上により、従来は人間が処理していた業務・クリエイティブ作業の大規模な自動化が現実化する。ただしセキュリティ領域では制限付き対応となり、悪用防止と防御ワークフロー支援のバランスを取る設計。 **用語説明** - **アラインメント|AIの判断や行動が人間の意図や価値観と一致すること** - **LLM|大規模言語モデル。膨大なテキストデータで学習した言語処理AI** - **ベンチマーク|AIの性能を測定する標準的なテスト** - **API|ソフトウェア同士が連携するための接続口** - **PoC|脆弱性を悪用する実証コード**

元記事を読む

編集・出典方針 · ニュースの読み方 · 記事一覧