AIニュース(2026年9月27日〜10月3日分)
今週はGPT-6.1 SolとClaude Sonnet 5.5の提供が始まり、GoogleはGemini 4 Argonを限られた利用者へ公開しました。画像を細かく直すFLUX 3 Image、声を作るEleven v4なども登場しています。10月4日時点で使える製品、対象のプラン、先行提供の条件を整理します。
OpenAI:GPT-6.1 Solと月額500ドルのPro
9月29日、OpenAIは仕事やコード作業向けのGPT-6.1 Solを発表しました。ChatGPT WorkとCodexではPlus、Pro、Business、Enterprise、Eduが対象です。EnterpriseとEduは初期設定で無効のため、管理者による有効化が必要です。通常のChatへの提供は今後の予定です。
APIでも利用できます。文章を処理する量の単位「トークン」で課金され、標準の料金は入力100万トークン当たり2ドル、出力は10ドルです。入力が27万2,000トークンを超える場合などには別の単価が適用されます。ChatGPTの月額料金とAPIの利用料金は別です。
同日、月額500ドルのProも追加されました。大きな利用枠と高速なGPT-6 Astra UltrafastをWork・Codexで使えるプランで、契約はWebから行います。
出典:DevDayの発表(9月29日)、GPT-6.1 SolのAPI条件、ChatGPTのプラン比較、更新履歴
Anthropic:Claude Sonnet 5.5
9月28日、AnthropicはClaude Sonnet 5.5を発表しました。Claudeのアプリ、Claude Code、APIに加え、AWS、Google Cloud、Microsoft Azureでも提供しています。APIのモデル名はclaude-sonnet-5-5です。
標準のAPI単価は入力100万トークン当たり2ドル、出力10ドルで、Sonnet 5と同じです。Anthropicは、作業に使うトークンを減らすことで、典型的な仕事の費用を最大30%抑えられると説明しています。作業全体の費用についての比較で、APIの単価は維持されています。
Google:Gemini 4 Argonは限定提供から
9月30日、GoogleはGemini 4 Argonを発表しました。コード作業や長い調査など、複数の手順を進める仕事に向けたモデルです。Fairwind Programに参加する信頼されたサイバー防御の担当者へ、先行して提供しています。
一般向けの提供は今後の予定です。Googleは、有料APIの利用者とGoogle AI Ultraの契約者から広げると説明しています。APIの導入価格は入力100万トークン当たり2ドル、出力10ドルを予定し、導入期間後は4ドル・20ドルになります。発表された最大100万トークンは、モデルが出力する量の上限です。
OpenAI:継続して仕事を進めるDots
9月29日、OpenAIはDotsを発表しました。利用者が目標と許可する作業範囲を渡すと、クラウド上のコンピューターや接続したアプリを使い、継続して仕事を進める機能です。GPT-6 Astraを使います。
18歳以上のProとBusiness Premium利用者のうち、対象地域のアカウントへ段階的に提供します。Proの初期提供では欧州経済領域、スイス、英国が対象外です。Enterpriseはベータ提供で、管理者が有効にする必要があります。作成する入口はデスクトップアプリとWebです。
出典:OpenAIの発表(9月29日)、対象者と地域の更新履歴
GitHub Copilot:モデル追加と画面操作
GitHub Copilotにも新モデルが加わりました。9月28日のClaude Sonnet 5.5はPro、Pro+、Max、Business、Enterpriseが対象です。9月29日のGPT-6.1 SolはPro+、Max、Business、Enterpriseへ提供します。いずれも段階的な展開で、組織の契約では管理者のモデル設定を確認する必要があります。
10月1日には、Copilotがデスクトップアプリを操作する公開プレビューも始まりました。macOSとWindowsのCopilot CLI・Copilotアプリが対象で、画面を読み、クリックや文字入力などを行えます。操作を許可するアプリを利用者が確認し、組織の管理者も利用を制御できます。
出典:Sonnet 5.5の追加、GPT-6.1 Solの追加、画面操作の公開プレビュー
Black Forest Labs:FLUX 3 Image
10月2日、Black Forest Labsの公式XはFLUX 3 Imageを紹介しました。画像の中で直したい場所を指定し、編集を重ねるモデルです。四角い枠で物を置く位置を指定でき、参照画像は最大10枚、生成する画像は最大4Kに対応すると説明しています。
APIとPlaygroundで利用できます。画像を作る際の利用料金と、商用向けモデルデータの契約条件はそれぞれ確認が必要です。
出典:公式Xの発表(10月2日)、FLUX 3 Imageの提供条件
ElevenLabs:Eleven v4とEleven v4 Turbo
9月28日、ElevenLabsは文章から声を作るEleven v4と、その高速版Eleven v4 Turboを発表しました。声の調子、間の取り方、感情などを文章で指示できます。両モデルは90を超える言語に対応するとしています。
ElevenAgents、ElevenCreative、ElevenAPIで提供しています。Turboは会話への応答を速くする用途に向けたモデルです。使える量や料金は契約するプランによって確認する必要があります。
出典:ElevenLabsの発表(9月28日、10月1日更新)
Microsoft:文字起こしと音声の新モデル
10月1日、MicrosoftはMAI-Transcribe-2-Streaming、MAI-Voice-2.1、MAI-Voice-2.1-Flashを発表しました。Streamingは、話している途中から文字起こしを返すモデルで、60言語に対応します。Voiceの2モデルは文章から声を作り、23言語に対応します。
3モデルはMicrosoft Foundryなどで利用できます。Streamingは公開プレビューです。年末までの導入価格は音声1時間当たり0.54ドル。Voice-2.1は入力100万文字当たり22ドル、Flashは15ドルです。
出典:Microsoftの発表(10月1日)、Streamingの提供段階
Tavus:映像と声で会話するGriffin
10月1日、Tavusは映像と声を同時に扱う会話モデルGriffinを紹介しました。相手の様子を見て声を聞き、応答やうなずきなどを返す仕組みです。
Griffin-Liteは、選ばれたテスター向けの研究プレビューです。一般の顧客向けの提供時期や料金はまだ示されていません。Tavusは、安全面の課題に対応したうえで、より高性能なモデルの提供を進めるとしています。
Ai2:出典付きの調査報告を作るAstaBrief
10月2日、Ai2はAstaBrief 8Bのモデルデータと学習データを公開しました。研究の質問と集めた論文の抜粋を渡すと、出典を付けた報告を作るモデルです。Astaの「Generate a report」ではFast modeとして利用でき、公開データを使って自分の環境で動かすこともできます。
