今日の見出し
- Mistralが1兆パラメーターの「Mistral Large 4」を公開プレビュー——重みは今月末に公開予定
- Anthropicがサイバー検証プログラムを拡大——審査に応じて3段階でサイバー能力を開放
- OpenAIが契約管理ソフトのIroncladと研究協力——契約業務の設定作業でエージェントを訓練
今日の3本はどれも、相手を選んで先に組む話です。Mistralは重みを公開する前に、審査を通した相手とモデルを試しています。Anthropicは、サイバー攻撃にも使える能力を、審査の段階に応じて防御側に開く制度に作り直しました。
OpenAIは、少数のソフトウェア会社と組み、その会社の製品を使う専門業務でエージェントを訓練する研究を始めました。最初の相手は契約管理のIroncladです。
今日の3本
Mistralが1兆パラメーターの「Mistral Large 4」を公開プレビュー——重みは今月末に公開予定
フランスのMistral AIが10月6日、新しい大型モデル「Mistral Large 4(ML4)」の公開プレビューを始めました。
ML4は総パラメーター1兆、1トークンあたりに動くパラメーターが490億のモデルで、文字と画像をはじめから一緒に扱う設計です。同社として最大のモデルで、プレビュー版のAPIは自社の「Mistral Studio」ですぐに使えます。
重みは今月末に公開する予定です。それまでの間、サイバーセキュリティの有力企業や審査を通したパートナー、国の当局と、実際の環境でレッドチーミングを進めます。これらの相手は、モデレーションを緩め、サイバー能力を広げた同じモデルを使います。
学習は、欧州にある自社データセンターのNVIDIA Grace Blackwell GPU 3,800基で、一から行いました。プレビューも同じ基盤で提供しています。学習データの多くは多言語で、EUのすべての公用語を含む160を超える言語にわたります。
同社は、サイバーセキュリティでの性能を強く打ち出しています。実在するオープンソースソフトの脆弱性を再現してから修正するテストで82%と、どのモデルよりも高い点を出したとしています。同じテストで、AnthropicのClaude Opus 5.5やOpenAIのGPT-6 Astraは、作業を拒否するためにほぼ0点だったと説明しています。
- Introducing Mistral Large 4(Mistral AI)
- Mistral's new 1T model aims to leapfrog closed and open rivals(TechCrunch)
Anthropicがサイバー検証プログラムを拡大——審査に応じて3段階でサイバー能力を開放
Anthropicが10月6日、セキュリティの専門家向けの「Cyber Verification Program(CVP)」を拡大し、3段階のアクセス区分に作り直しました。
一般に提供しているClaudeのモデルは、悪用を防ぐために、サイバーセキュリティの作業の大半をブロックしています。Anthropicはこの半年、重要なソフトを守る組織にClaude Mythosを提供する「Project Glasswing」と、審査を通したセキュリティチームにブロックを緩めたモデルを提供するCVPの二つを運用してきました。今回、この二つを一つの制度にまとめました。どの区分でも、Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1と、今後の新しいモデルが使えます。
一つ目の「Defense Access」は、セキュリティ監視やインシデント対応、マルウェアの解析、脆弱性の分析と検証といった防御の作業向けです。企業や非営利団体、大学、政府のセキュリティチームのほか、地域の病院や自治体の公益事業といった規模を問わない重要インフラの事業者、オープンソースのメンテナー、脆弱性の報告実績がある個人の研究者も対象になります。申請には数日で回答するとしています。
二つ目の「Red Team Access」は、許可を得たペネトレーションテストとレッドチーミングを加えた区分です。対象は組織だけで、審査には数週間かかる見込みです。ランサムウェアの展開など、物理的な被害や大規模な混乱につながる操作は、この区分でもその場でブロックされます。
三つ目の「Specialized Access」は、ブロックが最も少ない区分です。航空機の運航システムや電力網、通信網、銀行間の送金基盤、政府の行政ネットワークなど、人命や市場に影響しうるシステムのテストを認められた、限られた組織が対象です。現在は米国政府と連携して、組織ごとに詳しく審査しています。
参加する組織には、悪用を監視するためのデータ保持が求められます。Anthropicは、Project Glasswingの参加組織が2026年4月から7月までに、検証済みの脆弱性を少なくとも12万9,000件見つけたとしています。
OpenAIが契約管理ソフトのIroncladと研究協力——契約業務の設定作業でエージェントを訓練
OpenAIが10月6日、契約管理ソフトのIroncladと組み、契約業務の作業でAIエージェントを訓練・評価する研究協力を公表しました。
OpenAIは、専門的なソフトウェアを使う複雑な業務でエージェントを鍛えるため、少数のソフトウェア会社と直接組む方針です。Ironcladはその最初の相手です。両社は、法務・商取引・調達にわたる11の作業を選びました。秘密保持契約の作成手順の設定や、購買の承認プロセスの作成、申請者が選んだ法域に合わせて定型条項を書き換える作業などで、熟練した利用者でも1件あたり平均30〜40分かかると見積もっています。
各作業は、複雑さに応じて8〜50の基準で採点しました。Ironcladが練習用に自社製品の環境を用意し、OpenAIはそこで強化学習を行いました。
11の作業での平均点は、GPT-6 Astraが55.0%、前世代のGPT-5.6 Solが41.6%でした。1回あたりの推定所要時間は、Solの37.0分に対しAstraは19.2分です。推論の設定は、それぞれ最も点が高かったものを使いました。Astraの開発途中で使った社内モデルは63.7%を出しました。
IroncladのCTO、Sunita Verma氏は、エージェントには契約のライフサイクル全体を理解し、業務の流れがどうつながるかをつかむことが必要だと述べています。OpenAIは、いまのエージェントが確実にはこなせない専門業務を持つソフトウェア会社に、協力への応募を呼びかけています。
そのほかの動き
モデル
- Googleが、Gemma 4を土台にしたオープンな埋め込みモデル「EmbeddingGemma 2」を公開しました。パラメーターは7億4,000万で、文字・画像・音声・動画を一つの埋め込み空間で扱います。ライセンスはApache 2.0です。EmbeddingGemma 2: an open, lightweight multimodal embedding model(Google)
ビジネス
- AtlassianとOpenAIが提携を広げました。新しい契約で、OpenAIのフロンティアモデルがAtlassianのプラットフォームとRovoのエージェントを動かします。Atlassianでは3,000人を超える開発者がCodexを使っています。Atlassian and OpenAI expand partnership to turn enterprise knowledge into action(OpenAI)
- TechCrunchがWall Street Journalの報道として伝えたところでは、AI向けクラウドのLambdaが、プレマネー評価額145億ドルで最大40億ドルを調達します。受注残高は6月の150億ドルから9月には500億ドルに増え、増加分の多くはAnthropicによる350億ドルのコミットメントとされます。AI computing startup Lambda to raise $4B ahead of planned IPO(TechCrunch)
- Anthropicがスタートアップ支援の「Claude for Startups」を広げ、Claude Teamを最大5席まで1年間無料にし、APIのクレジット1,000ドルを付けると発表しました。対象は設立5年以内か、過去2年以内に資金を調達した会社です。Anthropic is giving startups a free year of Claude Team and $1,000 in credits(TechCrunch)
政策
- 欧州委員会が、AIのための欧州のデジタル空間「.IA」の創設を求める欧州市民イニシアチブを登録しました。ISOやICANNと交渉して「.IA」を欧州のデジタル主権の資産として確保することなどを求めています。少なくとも7加盟国で最低数を満たし、合計100万人以上の有効な署名が集まれば、欧州委員会は対応を決めます。Commission registers European Citizens' Initiative for sovereign European AI domains(欧州委員会)
プロダクト
- オフィスソフトLibreOfficeを開発する非営利団体The Document Foundationが、当面ソフトにAIを加えない方針を示しました。文書をサーバーに送らず、ネットワークにつながなくても動くことを意図した設計だと説明しています。LibreOffice says 'no AI' is now a software feature(TechCrunch)
その他
- TechCrunchによると、AmazonがMetaの個人向けエージェント「Muse」の自社サイトでの利用をブロックし始めました。Meta、Walmart、Stripeなどは、エージェントの受け入れ方を定めるオープンな標準づくりに取りかかっています。The next hurdle for AI agents: getting websites to let them in(TechCrunch)
ソース: AIニュースインボックス(2026年10月7日収集・30件、一次13件・二次17件)から編集部が選定しました。