AIコラム

EDITORIAL

新聞の社説テイストで綴る、AIと社会についての考察。速報ではなく、一晩寝かせた思考を載せる場所です。

AIコラム

三巨人が競い合う夏——私たちは何を手元に持って歩くか

この夏のフロンティアAIは、まるで三者が覇を競う群雄割拠のようです。覇者OpenAI、目を覚ました老雄Google、旗手Anthropic——三巨人が次のモデルを出そうとし、米政府は一つのモデルを止め、予測市場はざわつき、私たちは噂に一喜一憂しています。この夏の動きを、確報と噂を見分けながら、軽やかにご一緒に見ていきましょう。

AIコラム

70行の「叱り方」が20万スターを集めた理由

たった70行のテキストファイルがGitHubで20万近い星を集めました。その正体は機能でも製品でもなく、有能な部下への「叱り方」を言語化した一枚の指示書です。AIを律する技術は、そのまま組織を律する技術に重なります。

AIコラム

Legal Agent Benchmarkとは何か―ISDA関連のタスク・ベンチマーク評価基準の分析と考察

法務AI企業Harveyが公開したLegal Agent Benchmark(LAB)は、最強モデルでも13.3%という苛烈なベンチマークです。本稿は、誰がどう作ったのかという基礎から、ISDA・CSA・レポ取引という金融法務の具体タスクの中身、そして「全問正解でなければ0点」という採点設計の急所までを読み解きます。

AIコラム

犯罪ゼロの都市と、4日で滅んだ都市——AIエージェント社会実験が示す「性格」という新しい選定軸

米Emergence AIが、自律AIエージェント10体に仮想都市を運営させる実験「Emergence World」の結果を公表しました。同じ街・同じルールでも、頭脳となるモデルが違えば、犯罪ゼロの秩序都市から4日で滅びる都市まで、社会の姿は一変しました。ベンチマークが測る「賢さ」と、社会に放ったときの「振る舞い」は別物である——エージェント運用時代のモデル選定に、新しい問いが加わりつつあります。