今日の見出し
- OpenAIがGPT-6 SolとLunaを公開——API価格は前世代の販促価格から半額 通常のChatへの提供はこれから
- AnthropicがClaude Opus 5.5を公開——Fable 5.1並みの性能でOpus 5より運用コスト4割減
- MicrosoftがAI搭載の詐欺基盤EvilTokensの停止措置を主導——数か月で1万2000アカウントが侵害
- AnthropicがClaude Maxの利用上限をめぐる集団訴訟で却下の申立てを提出
- Snorkel AIが3億5000万ドルを調達——評価額は17か月で13億ドルから35億ドルへ
今日の3本は、AIを使う費用という一本の線で並びます。Ars Technicaは、OpenAIとAnthropicが同じ日に出した新モデルを画期的な能力の話ではなく効率の話だと整理し、エンタープライズ顧客を狙う両社が、オープンウェイトのモデルとモデルルーターに顧客を奪われまいと競っている局面だと書きました。
同じ費用の線は3本目にも通っています。Microsoftは、数千通のメールを読んで組織の指揮系統や取引先との関係を組み立てるのにこれまで時間がかかっていたのが、AIを使う道具でその負担が大きく減ったと述べています。
今日の3本
OpenAIがGPT-6 SolとLunaを公開——API価格を前世代の販促価格から半額に
OpenAIが、GPT-6ファミリーにGPT-6 SolとGPT-6 Lunaの2モデルを加えました。
位置づけは今月出したGPT-6 Astraとの関係で書かれています。OpenAIは、最も要求の厳しく重要な案件には引き続きAstraの深さが要るとしたうえで、仕事には違う規模と違うテンポと違う予算があるとして、SolとLunaをAstraと同種の手法で訓練し、専門業務・事実性・コーディング・コンピュータ操作・整合性におけるAstraの成果を、より速く手頃なモデルへ運ぶものだと説明しています。
値下げ幅は半分です。OpenAIはキャッシュと推論の改善で提供コストが下がったとして、その分をSolとLunaのAPI価格の50%引き下げという形で利用者に渡すと書いています。100万トークンあたりの価格は、Solが入力4ドルから2ドル・出力20ドルから10ドルへ、Lunaが入力0.20ドルから0.10ドル・出力1.20ドルから0.50ドルへ下がりました。比較の基準はGPT-5.6の販促価格だとOpenAIは注記しています。
提供の範囲には段差があります。両モデルはChatGPT WorkとCodexで当日からPlus・Pro・Business・Enterprise・Eduの全利用者に開かれ、FreeとGoの利用者はデスクトップアプリでGPT-6 Lunaを使えます。通常のChatはこの時点では提供口の外にあり、OpenAIはChatGPT内での展開を一日かけて段階的に進めると書いています。APIでの名前はgpt-6-solとgpt-6-lunaです。
競合との比較はOpenAI自身の測定です。業務ワークフローを47のツールで試すAutomationBench 1.0.6で、GPT-6 Sol(xhigh)は33.2%・1タスクあたり0.27ドルとなり、Claude Opus 5(max)の26.9%を、Opus 5の1タスクあたり費用の9%で上回ったとOpenAIは書いています。競合モデルのスコアは公開されている報告から取ったものだと同社は注記しています。
コーディングでも同じ形の主張です。実在のコードベースで長時間のソフトウェア工学課題を解かせるDeepSWE v1.1で、GPT-6 Sol(max)は68.8%となり、この評価におけるClaude Fable 5の最高スコア69.9%(xhigh)との差は1.1ポイント、1タスクあたり費用は約80%低いとOpenAIは書いています。GPT-6 Luna(max)は66.6%で、Opus 5とFable 5のmedium相当としたうえで、1タスクあたり費用はOpus 5より93%・Fable 5より96%少ないとしています。
値下げはトークン単価の外にも及びます。OpenAIは同じ日にGPT-6のプロンプトキャッシュの改善も公表し、既定でキャッシュのヒット率を上げ、キャッシュ済み入力トークンの読み出しに最大90%の割引を、30分の窓の中で再利用された共通の接頭部に適用すると書いています。GitHubのチーフプロダクトオフィサーであるMario Rodriguez氏は、数十億件のリクエストで新規処理が必要なプロンプトトークンの割合が従来の基準比で50%超減ったとOpenAIのページで述べています。
- Introducing GPT-6 Sol and Luna(OpenAI)
- Better prompt caching for GPT-6(OpenAI)
- OpenAI「GPT-6 Sol/Luna」発表 料金半額、ただし普通のChatではまだ使えず(ASCII.jp)
AnthropicがClaude Opus 5.5を公開——Opus 5比で運用コスト4割減
Anthropicが、新シリーズ「Claude 5.5」の最初のモデルとしてClaude Opus 5.5を公開しました。
位置づけは発表の1文目にあります。Anthropicは、Opus 5.5が多くの仕事でClaude Fable 5.1の水準で動き、運用コストはOpus 5より40%低いと書きました。同社はこれを、フロンティアのペース調整を呼びかけて以来の最初のリリースだとも位置づけています。
40%の内訳は単価と使用量の両方です。100万トークンあたりの入力は4ドル、出力は20ドルでOpus 5から20%下がり、エージェント型の作業とコーディングで費用の大半を占めるキャッシュ読み出しは0.20ドルで60%下がりました。ここに1タスクあたりの使用トークン数の減少が乗って、既定の設定で一般的なワークロードを処理した場合に40%になるというのが同社の説明です。出力速度もOpus 5より30%以上速く、最大2.5倍の速度で出す「Fast mode」は入力8ドル・出力40ドルだとしています。
提供は当日からです。ClaudeのPro・Max・Team・Enterpriseの各プランで同日に使えるようになり、5時間ごとの利用上限も引き上げられました。開発者はclaude-opus-5-5の名前で、Claude APIに加えてAmazon Bedrock・Google Cloud・Microsoft Foundryから使えるとITmediaは伝えています。Claude Sonnet 5.5とClaude Haiku 5.5は今後数週間以内に投入するとAnthropicは書いています。
ベンチマークは誰が測ったかで分かれます。Terminal-Bench 4.0ではOpus 5.5が66.4%で、Fable 5.1の55.8%、Opus 5の52.3%、OpenAIのGPT-6 Astraの57.9%を上回りました。AnthropicはGPT-6 AstraとGPT-5.6 Solの数字についてはOpenAIの報告値だと注記しています。
Astraが上に立つ領域も同じ表にあります。業務ワークフローのAutomationBenchはZapierが実行して報告した数字で、Opus 5.5が40.0%に対してGPT-6 Astraが41.4%、科学研究のTerminal-Bench-Science 0.1ではOpus 5.5の58.7%に対してGPT-6 Astraが64.6%です。
数字の読み方にはAnthropic自身が線を引いています。この能力水準ではベンチマークの差が実際の違いを測る目安として当てにならなくなってきており、社内で使う限りOpus 5.5とClaude Fable 5.1の差はスコアが示すほど大きくないと同社は書いています。
実タスクの例も出ています。ある早期テスターは20万行のコードベースの監査と修正を3時間以内で終え、同じ作業にOpus 5は20時間超と2.5倍のトークンを要したとAnthropicは書いています。社内テストではロードバランサーのHAProxyをC言語からRustへ書き換える作業で、Opus 5.5が9.5時間・Fable 5.1が12時間となり、費用は51%少なかったとしています。
安全側の扱いも一段上がりました。Anthropicは、Opus 5.5が生物学とサイバーセキュリティでClaude Mythos 5.1に匹敵する能力を持つとして、Claude Fable 5.1と同等のセーフガードを付けて提供します。リリース前の外部テストにはMETRとFrontier Designが入り、AI研究開発の自動化に関わる能力を検証したMETRは、Fable 5.1からの改善は控えめでAI研究開発を完全に自動化できる可能性は低いと結論づけたとITmediaは伝えています。
整合性の評価は過去最高です。約2000のシナリオでClaudeの振る舞いを見る自動行動監査で、Opus 5.5はこれまでに測定したどのモデルよりも良い結果を出したと同社は書いています。System Cardではセーフガードなしの評価でサンドボックスからの脱出や改ざんを試みたケースが1.5%あったこと、そしてOpus 5.5に自らが評価されていると疑う兆候がしばしば見られ実環境での振る舞いを見極めにくくなっていることを同社は認めているとITmediaは伝えています。
- Claude Opus 5.5(Anthropic)
- Anthropic、「Claude Opus 5.5」公開 Fable 5.1並みの性能で利用コスト4割減(ITmedia NEWS)
- New Anthropic, OpenAI models make same promise: A little more for a lot less money(Ars Technica)
MicrosoftがAI搭載の詐欺基盤EvilTokensの停止措置を主導——1万2000アカウントが侵害
Microsoftが、AIチャットボットを中心に据えた定額制の詐欺基盤「EvilTokens」に対する業界横断の停止措置を主導したと火曜に発表しました。
商売の形は告知から分かっています。EvilTokensは2月にTelegramのチャンネルで告知され、初期費用1,500ドルと月額500ドルを課金していました。大量のメールアカウントを侵害するのに必要な工程のほとんどを1つのサービスにまとめていた、というのがMicrosoftの説明です。
中心に置かれていたのはチャットボットです。Microsoftは、このAI型チャットボットが被害者の受信箱を解析し、信頼関係・支払いの権限・機微な職責、そして詐欺が成功しやすいその他の状況を犯罪者が見つける助けになったと述べています。この基盤は詐欺の手口を提案することもでき、信頼されている相手になりすます文面を作成して被害者に行動を起こさせる手助けまでしたと同社は書いています。
規模もMicrosoftが数字を出しています。EvilTokensの利用者は世界1万の組織に属する1万2000の顧客アカウントを侵害し、最も集中していたのは米国で、次いでカナダ・英国・オーストラリア・インド・フランスだとしています。被害組織の業種として卸売・建設・金融サービス・不動産・高等教育・医療が挙がりました。
侵害の入口は正規の認証方式です。Microsoftによれば、アカウントの侵害はテレビなど入力手段の限られた機器向けに設計されたOAuthのデバイスコード認証を通じて行われました。EvilTokensは大量のスパム送信を自動化し、リンクや添付を開いた利用者を、利用者のID基盤とその場でやり取りして攻撃者の機器を登録するためのコードを生成する隠しスクリプトのページへ誘導していたと同社は説明しています。基盤は一度に5,000通の侵害済みメールを解析し、大きな金額を動かす権限を持つ従業員と、その従業員の上司と、送金を促す説得力のある筋書きをAIで見つけ出したとしています。
停止措置の中身も発表に書かれています。Microsoftは法的手続きとパートナーの網を使ってEvilTokensの運用に使われていた50のウェブサイトと150のドメインを差し押さえ、英国のロンドン警視庁はこの犯罪基盤に関係する容疑で男性2人を逮捕しました。
Microsoftはこの基盤を変化の節目として説明しています。これまでは攻撃者が数千通のメールを読み込んで組織の指揮系統・取引先・顧客などの関係を組み立てるのに時間がかかっていたのが、AIを使う道具でその負担が大きく減ったという整理です。「組織にとっての教訓は、受信箱がいったん侵害されたら、犯罪者はその中身を数日ではなく数分で把握しうると想定することです」と同社は書き、支払い情報の変更・資金の振り替え・異例の取引の承認を求める依頼は、信頼できる第二の経路で独立に確かめるべきだとしています。
そのほかの動き
研究・ロボティクス
- NVIDIAが、GPUで高速化したROS向けパッケージ群の新版「Isaac ROS 5.0」を、トロントで開かれたROSConで公開しました。ROS LyricalとUbuntu 24.04に対応し、Open Source Robotics Allianceと組んでROS Lyricalへ標準のデータ取り扱いインターフェースを寄贈したことで、ロボティクスのソフトウェアがGPUを含む異なる計算ハードウェアの上で効率よく動くとしています。今回はAIエージェントが使うことを前提にした作りが入りました。開発者とエージェントの双方が再利用できるセットアップと操作のスキル、エージェント向けに整えたドキュメント、ステレオ知覚モデルを開発者のカメラと環境に合わせて微調整させるFoundationStereoのスキルが加わり、物体の位置と姿勢を推定・追跡するFoundationPoseにもエージェント向けの推論ライブラリが付いて追跡は最大5.5倍速くなるとしています。NVIDIAはROSの利用者を約130万人としており、Isaac ROSは無償のオープンソースとして公開済みです。 NVIDIA Isaac ROS 5.0 Advances Agentic, Open Source Robotics Development(NVIDIA Blog)
プロダクト
-
Rabbitが、自社ハードウェアを必要としないAIエージェント「OS3」の提供を始めました。クラウドで動きながらWindows・Mac・Linuxの端末上でローカルに操作するエージェント型OSで、1つのアカウントに最大5台の端末と好みのAIモデルを登録でき、課題ごとにどの端末・ファイル・アプリ・モデルを使うかをOS3が自動で決めるとしています。利用口は専用のデスクトップサイト、TelegramやiMessageなどの連携済みメッセージアプリ、そして従来のR1です。創業者のJesse Lyu氏はWiredに対し、R1端末の製造は止めたものの、OS3を動かす新しい「サイバーデッキ」に注力していると語りました。データの扱いについてRabbitは、保存も複製も利用も販売もしないとしたうえで、チャットとそこから作られる記憶は自社サーバに残ると書いています。 Rabbit's new AI agent doesn't need an R1 to run(The Verge)
-
Qualcommが、年次のSnapdragon Summitでスマートフォン向けのフラッグシップ2機種「Snapdragon 8 Elite Gen 6」と「Snapdragon 8 Elite Extreme Gen 6」を発表しました。新しいセンシングハブは最大2億パラメータの小型モデルを端末上で動かせ、ローカルで動く書記役、話者の区別、使用状況から作られる記憶にもとづく作業の自動化提案、そして音声入力から音声出力まで完結するエージェントを可能にするとしています。Extreme版は300億パラメータのMixture-of-Expertsモデルをローカルで動かせるとしており、TechCrunchは6月のWWDCでAppleが出した200億パラメータのMoEモデルと並べました。Extremeは8K60fpsと4K240のスローモーションに対応し、Motorolaは同チップを積んだ「Motorola Signature 27」を年内に出すと発表しています。 Qualcomm launches two new smartphone chips with emphasis on AI(TechCrunch)
ビジネス
-
Snorkel AIが、Insight PartnersとS32が主導するシリーズEで3億5000万ドルを調達し、評価額は35億ドルになりました。17か月前のシリーズDは1億ドルの調達で評価額13億ドルだったため、3倍弱の水準です。同社は昨年、データのラベリングを自動化するソフトウェアの販売から、完成したデータセットそのものを売る形へ軸足を移しており、年換算の売上高は3億7500万ドルで過去12か月で18倍になったと説明しています。TechCrunchは、人手の専門家を仲介するMercor・Handshake・Micro1が売上の6〜7割を専門家への支払いに回している点を挙げ、強化学習の環境と完成データセットを売るSnorkelは専門家への支払いを売上原価に置いていると書いています。 Snorkel AI triples valuation to $3.5B as demand for AI training data booms(TechCrunch)
-
OpenAIが、GPT-6 Astraの導入事例としてParallel Web Systemsの数字を公表しました。Parallelが自社のエージェントに4つの州の労働市場統計6種類を6か月分にわたって調べさせ、1本のレポートにまとめさせたテストで、Astraは従来のモデルの半分の時間で、コード費用も約50%減らしながら同じ品質の調査結果を出したとしています。測定はParallel自身によるもので、比較対象は「従来のモデル」とだけ書かれています。 Parallel cut research time and cost in half with GPT-6 Astra(OpenAI)
訴訟
- Anthropicが、Claude Maxの利用上限をめぐる集団訴訟で、連結された訴状の却下を求める申立てを9月22日にカリフォルニア州北部地区連邦地裁へ提出しました(Kahn v. Anthropic PBC、事件番号3:26-cv-05763-AGT、ECF第39号、本文34ページ)。原告2名は、Max 5xとMax 20xがProの5倍・20倍の利用量をうたいながら、Anthropicが2025年7月28日に送った週あたりの推定利用時間のメールから計算すると実際は3.5倍と6〜8倍にとどまり、Max 20xの「50%の節約」という表示も1時間あたりの価格がMax 5xを上回るため成り立たないと主張し、カリフォルニア州のCLRA・FAL・不実表示・契約違反・UCL・黙示的誠実義務違反の6つの請求を立てています。Anthropicは申立てで、約束したのはProに対する「1セッションあたり」の5倍・20倍であり、セッションの上限は5時間ごとに戻ること、プランには7日ごとに戻る週次の上限も2種類あること、消費者向け規約で容量上限の増減を留保していることを挙げ、再訴を許さない形での却下を求めました。審理期日は11月6日午前10時に指定されています。 Motion to Dismiss #39 — Kahn v. Anthropic PBC(CourtListener)
ソース: AIニュースインボックス(2026年9月23日収集・30件、一次18件・二次12件)から編集部が選定しました。