生成AI-Labについて
GorillAI(ゴリライ)
生成AI初心者。
ChatGPT先生と様々なAIツールを駆使して、問題解決に取り組み中。
生成AIの身近な使い方から問題解決のために、工夫を凝らしています。。。
生成AI年表
2022年発表のAI関連
- Stable Diffusion |Stability AI 2022年8月リリース
- DALL-E 2|OpenAI 2022年9月リリース
- ChatGPT(GPT-3.5)|OpenAI 2022年11月リリース
2023年発表のAI関連
- ChatGPT(GPT-4)|OpenAI 2023年3月リリース
- Copilot for Microsoft 365|Microsoft 2023年3月リリース
- cotomi|NEC 2023年7月リリース
- Stable Diffusion XL 1.0|Stability AI 2023年7月リリース
- Llama 2|Meta 2023年7月リリース
- Runway Gen-2|Runway AI 2023年8月リリース
- DALL-E 3|OpenAI 2023年9月リリース
- Gemini|Google 2023年12月リリース
- MidJourney v6|MidJourney 2024年12月リリース
2024年発表のAI関連
- Stable Diffusion 3|Stability AI 2024年2月リリース
- Llama 3|Meta 2024年4月リリース
- ChatGPT(GPT-4o)|OpenAI 2024年5月リリース
- Claude 3.5 Sonnet|Anthropic 2024年6月リリース
- Dream Machine|Luma AI 2024年6月リリース
- MidJourney v6.1|MidJourney 2024年7月リリース
- Runway Gen-3|Runway AI 2024年7月リリース
- Llama 3.1|Meta 2024年7月リリース
- Adobe Firefly|Adobe 2024年9月リリース
- Stable Diffusion 3.5|Stability AI 2024年10月リリース
- Gemini2.0|Google 2024年12月リリース
📊 2025年発表 主要AIモデル・サービス(完全版)
1月
| モデル | 企業 | 特徴 |
|---|
| DeepSeek-V3 | DeepSeek(中国) | GPT-4o・Claude 3.5 Sonnetに匹敵、低コスト実現 |
| DeepSeek-R1 | DeepSeek(中国) | 推論特化、o1レベルの性能で世界的衝撃 |
2月
| モデル | 企業 | 特徴 |
|---|
| Sora | OpenAI | 最長1分の高品質動画生成、物理演算再現 |
| Gemini 2.0 | Google | マルチモーダル強化、思考プロセス表示機能 |
| Grok 3 | xAI | ベンチマーク競合上回る性能 |
| Claude 3.7 Sonnet | Anthropic | ハイブリッド推論、Thinking Mode搭載、コーディング最高峰 |
| Wan 2.1 | Alibaba Cloud | 動画生成、Image-to-Video性能高評価 |
| GPT-4.5 | OpenAI | 知識量増加、ハルシネーション低減 |
| Rakuten AI 2.0 | 楽天(日本) | MoEアーキテクチャ、日本語タスク最適化 |
3月〜8月
| モデル | 企業 | 特徴 |
|---|
| Gemini 2.5 Pro | Google | 推論機能をデフォルト搭載 |
| Gemma 3 | Google | 軽量オープンソース、単一GPU/TPUで最高性能 |
| Llama 4 | Meta | 業界最大GPUクラスターで学習中 |
| GPT-5シリーズ | OpenAI | 推論能力・精度向上 |
9月〜10月
| モデル | 企業 | 特徴 |
|---|
| Sora 2 | OpenAI | 品質・一貫性大幅向上 |
| Codex | OpenAI | コーディング特化、正式リリース |
| GPT-5 Pro | OpenAI | 最上位モデル、API提供 |
| tsuzumi 2 | NTT(日本) | 1GPU対応、日本語LLM、オンプレミス対応 |
11月
| モデル | 企業 | 特徴 |
|---|
| Gemini 3 | Google | GPT-5.1・Claude上回る性能 |
その他2025年発表
2026年1月~7月の発表モデルを、月別でまとめました。
| モデル | 企業 | 特徴 |
|---|
| Hunyuan T1 | Tencent(中国) | OpenAIの10分の1コストで2倍速度 |
| Qwen2.5-Omni-7B | Alibaba(中国) | マルチモーダル、モバイル効率処理 |
📅 2026年1月~7月 AI発表モデル徹底整理
1月 〜 予想段階
| モデル | 企業 | 発表形式 | 特徴 |
|---|
| Claude Opus/Sonnet/Haiku 5 | Anthropic | 予想 | ファミリー更新予定 |
| Meta「Avocado」 | Meta | 開発中 | テキスト/コード、課金化検討 |
| Meta「Mango」 | Meta | 開発中 | 画像・動画生成、Instagram/Reels向け |
2月中旬(モデル集中投入期)
2月には7つの主要AIモデルのリリースが集中 Kuma-base
| モデル | 企業 | 発表日 | 特徴 |
|---|
| Claude Sonnet 4.6 | Anthropic | 2月17日 | 速度と知性のバランス、1Mトークン対応 |
| Gemini 3 Pro GA | Google | 2月中 | 一般提供開始 |
| GPT-5.3 | OpenAI | 2月投入予測 | – |
| Nemotron 3ファミリー | NVIDIA | 2月 | エージェントAI向け |
3月
| イベント | 企業 | 発表日 | 内容 |
|---|
| Sora 2サービス終了発表 | OpenAI | 3月24日 | アプリ終了:4月26日、API終了:9月24日予定 |
4月
| モデル | 企業 | 発表日 | 特徴 |
|---|
| GPT-5.5 | OpenAI | 4月23日 | エージェンティックAI、複雑な自律型タスク遂行特化 |
| MAIシリーズ拡充 | Microsoft | 4月 | MAI-Transcribe-1, MAI-Voice-1, MAI-Image-2等 |
5月 〜 大型発表ラッシュ月
5月初旬
| モデル | 企業 | 発表日 | 特徴 |
|---|
| Gemma 4 | Google | 5月5日 | オープンモデル陣営の主導権奪還、MTPドラフター推論3倍高速化 |
Google I/O 2026(5月19日-20日開催)
GoogleはカリフォルニアでGoogle I/Oを開催し、13項目の主要発表 Labmemo
| モデル/機能 | 特徴 |
|---|
| Gemini 4 | クローズドフロンティアの最先端確立 |
| Gemini 3.5 Flash | エージェントタスク・ツール呼び出し特化 |
| Omni Flash | マルチモーダル(テキスト・画像・動画・音声)対応 |
| Veo 3 | 史上初の音声付き動画生成 |
| Antigravity CLI 2.0 | 旧Gemini CLIの完全な後継、Claude Code・Codexと競合 |
| Project Astra | AIエージェント向けプラットフォーム |
| Android 17 | Project Astra統合、OS層でのAI浸透加速 |
5月28日
| モデル | 企業 | 特徴 |
|---|
| Claude Opus 4.8 | Anthropic | 5月28日にリリース、エージェントコーディング大幅改善、コード誤り確率4分の1に低下 |
5月末~6月初旬
| モデル | 企業 | 特徴 |
|---|
| Claude Mythos | Anthropic | 高度なサイバーセキュリティ能力(後に規制対象化) |
6月 〜 規制・統合期
6月初旬(Microsoft Build 2026)
| モデル | 企業 | 特徴 |
|---|
| MAI-Transcribe-1 | Microsoft | 音声認識 |
| MAI-Voice-1 | Microsoft | 音声生成 |
| MAI-Image-2 | Microsoft | 画像生成 |
| その他 | Microsoft | コード生成含む7モデル群 |
6月12日 〜 歴史的な規制対応
Anthropicは米国政府指令により、Claude Fable 5とClaude Mythos 5へのアクセスをグローバルで即時停止。ハードウェアではなくソフトウェアモデルへの規制は史上初 Uravation
影響:
- Fable 5で作成したプロンプトが急に動作停止
- 代替:Claude Opus 4.8またはSonnet 4.6
- 性能は若干落ちるが、Opus 4.8は100万トークンコンテキスト対応
6月中旬
| 発表事項 | 企業 | 内容 |
|---|
| Anthropic Marketplace | Anthropic | 新機能・ツール拡充 |
| Claude動的ワークフロー | Anthropic | 中小企業向け実務対応 |
| Computer Use API | Anthropic | タスク自動化機能 |
7月 〜 復帰・拡張・国際展開期
7月1日
| イベント | 企業 | 内容 |
|---|
| サービス復帰 | Anthropic | 約3週間の停止を経て復帰 |
| Sonnet 5追加 | Anthropic | 新ラインナップに加わる |
7月16日
| モデル | 企業 | 特徴 |
|---|
| Kimi K3 | Moonshot AI(中国) | 約2.8兆パラメータ、100万トークン、オープンウェイト史上最大級、7月27日フルウェイト公開予定 |
| NVIDIA Vera Rubin AIファクトリー | NVIDIA | 日本・Noetra連携、フィジカルAI向け国家規模インフラ、経済産業省支援 |
7月21日-22日
| モデル | 企業 | 特徴 |
|---|
| Gemini 3.5 Pro GA | Google | 最大200万トークンコンテキスト、一般提供開始 |
| Gemini 3.5 Flash | Google | 日本語性能・検索連携で評価高い |
| セキュリティ特化モデル | Google | 複数新モデル発表 |
| ZCode | Z.ai(中国) | GLM-5.2ベース、BYOK対応、20種類以上ツール連携、月額$16~ |
| モデル | 企業 | 特徴 |
|---|
| Hunyuan T1 | Tencent(中国) | OpenAIの10分の1コストで2倍速度 |
| Qwen2.5-Omni-7B | Alibaba(中国) | マルチモーダル、モバイル効率処理 |
生成AI最新情報
2025年3月21日
OpenAIが開発したGPT-4o-mini-ttsは、高性能なTTS(Text-to-Speech)モデルです。このモデルはテキストを読み上げる際に、自然なイントネーションや感情表現を加えることができます。従来のTTS […]
2025年3月2日
アリババクラウド(中国のネット通販大手アリババグループの一員)が、画像や動画を生成するAIの基盤モデル「Wan2.1」をオープンソース化することを発表しました。 この取り組みによりサービスなどの利用がさらに広がることを目 […]
生成AI-Blog