home

生成AI-Labについて

GorillAI(ゴリライ)

生成AI初心者。
ChatGPT先生と様々なAIツールを駆使して、問題解決に取り組み中。
生成AIの身近な使い方から問題解決のために、工夫を凝らしています。。。

生成AI年表

2022年発表のAI関連

  • Stable Diffusion |Stability AI 2022年8月リリース
  • DALL-E 2|OpenAI 2022年9月リリース
  • ChatGPT(GPT-3.5)|OpenAI 2022年11月リリース

2023年発表のAI関連

  • ChatGPT(GPT-4)|OpenAI 2023年3月リリース
  • Copilot for Microsoft 365|Microsoft 2023年3月リリース
  • cotomi|NEC 2023年7月リリース
  • Stable Diffusion XL 1.0|Stability AI 2023年7月リリース
  • Llama 2|Meta 2023年7月リリース
  • Runway Gen-2|Runway AI 2023年8月リリース
  • DALL-E 3|OpenAI 2023年9月リリース
  • Gemini|Google 2023年12月リリース
  • MidJourney v6|MidJourney 2024年12月リリース

2024年発表のAI関連

  • Stable Diffusion 3|Stability AI 2024年2月リリース
  • Llama 3|Meta 2024年4月リリース
  • ChatGPT(GPT-4o)|OpenAI 2024年5月リリース
  • Claude 3.5 Sonnet|Anthropic 2024年6月リリース
  • Dream Machine|Luma AI 2024年6月リリース
  • MidJourney v6.1|MidJourney 2024年7月リリース
  • Runway Gen-3|Runway AI 2024年7月リリース
  • Llama 3.1|Meta 2024年7月リリース
  • Adobe Firefly|Adobe 2024年9月リリース
  • Stable Diffusion 3.5|Stability AI 2024年10月リリース
  • Gemini2.0|Google 2024年12月リリース

📊 2025年発表 主要AIモデル・サービス(完全版)

1月

モデル企業特徴
DeepSeek-V3DeepSeek(中国)GPT-4o・Claude 3.5 Sonnetに匹敵、低コスト実現
DeepSeek-R1DeepSeek(中国)推論特化、o1レベルの性能で世界的衝撃

2月

モデル企業特徴
SoraOpenAI最長1分の高品質動画生成、物理演算再現
Gemini 2.0Googleマルチモーダル強化、思考プロセス表示機能
Grok 3xAIベンチマーク競合上回る性能
Claude 3.7 SonnetAnthropicハイブリッド推論、Thinking Mode搭載、コーディング最高峰
Wan 2.1Alibaba Cloud動画生成、Image-to-Video性能高評価
GPT-4.5OpenAI知識量増加、ハルシネーション低減
Rakuten AI 2.0楽天(日本)MoEアーキテクチャ、日本語タスク最適化

3月〜8月

モデル企業特徴
Gemini 2.5 ProGoogle推論機能をデフォルト搭載
Gemma 3Google軽量オープンソース、単一GPU/TPUで最高性能
Llama 4Meta業界最大GPUクラスターで学習中
GPT-5シリーズOpenAI推論能力・精度向上

9月〜10月

モデル企業特徴
Sora 2OpenAI品質・一貫性大幅向上
CodexOpenAIコーディング特化、正式リリース
GPT-5 ProOpenAI最上位モデル、API提供
tsuzumi 2NTT(日本)1GPU対応、日本語LLM、オンプレミス対応

11月

モデル企業特徴
Gemini 3GoogleGPT-5.1・Claude上回る性能

その他2025年発表

2026年1月~7月の発表モデルを、月別でまとめました。

モデル企業特徴
Hunyuan T1Tencent(中国)OpenAIの10分の1コストで2倍速度
Qwen2.5-Omni-7BAlibaba(中国)マルチモーダル、モバイル効率処理

📅 2026年1月~7月 AI発表モデル徹底整理

1月 〜 予想段階

モデル企業発表形式特徴
Claude Opus/Sonnet/Haiku 5Anthropic予想ファミリー更新予定
Meta「Avocado」Meta開発中テキスト/コード、課金化検討
Meta「Mango」Meta開発中画像・動画生成、Instagram/Reels向け

2月中旬(モデル集中投入期)

2月には7つの主要AIモデルのリリースが集中 Kuma-base

モデル企業発表日特徴
Claude Sonnet 4.6Anthropic2月17日速度と知性のバランス、1Mトークン対応
Gemini 3 Pro GAGoogle2月中一般提供開始
GPT-5.3OpenAI2月投入予測
Nemotron 3ファミリーNVIDIA2月エージェントAI向け

3月

イベント企業発表日内容
Sora 2サービス終了発表OpenAI3月24日アプリ終了:4月26日、API終了:9月24日予定

4月

モデル企業発表日特徴
GPT-5.5OpenAI4月23日エージェンティックAI、複雑な自律型タスク遂行特化
MAIシリーズ拡充Microsoft4月MAI-Transcribe-1, MAI-Voice-1, MAI-Image-2等

5月 〜 大型発表ラッシュ月

5月初旬
モデル企業発表日特徴
Gemma 4Google5月5日オープンモデル陣営の主導権奪還、MTPドラフター推論3倍高速化
Google I/O 2026(5月19日-20日開催)

GoogleはカリフォルニアでGoogle I/Oを開催し、13項目の主要発表 Labmemo

モデル/機能特徴
Gemini 4クローズドフロンティアの最先端確立
Gemini 3.5 Flashエージェントタスク・ツール呼び出し特化
Omni Flashマルチモーダル(テキスト・画像・動画・音声)対応
Veo 3史上初の音声付き動画生成
Antigravity CLI 2.0旧Gemini CLIの完全な後継、Claude Code・Codexと競合
Project AstraAIエージェント向けプラットフォーム
Android 17Project Astra統合、OS層でのAI浸透加速
5月28日
モデル企業特徴
Claude Opus 4.8Anthropic5月28日にリリース、エージェントコーディング大幅改善、コード誤り確率4分の1に低下
5月末~6月初旬
モデル企業特徴
Claude MythosAnthropic高度なサイバーセキュリティ能力(後に規制対象化)

6月 〜 規制・統合期

6月初旬(Microsoft Build 2026)
モデル企業特徴
MAI-Transcribe-1Microsoft音声認識
MAI-Voice-1Microsoft音声生成
MAI-Image-2Microsoft画像生成
その他Microsoftコード生成含む7モデル群
6月12日 〜 歴史的な規制対応

Anthropicは米国政府指令により、Claude Fable 5とClaude Mythos 5へのアクセスをグローバルで即時停止。ハードウェアではなくソフトウェアモデルへの規制は史上初 Uravation

影響:

  • Fable 5で作成したプロンプトが急に動作停止
  • 代替:Claude Opus 4.8またはSonnet 4.6
  • 性能は若干落ちるが、Opus 4.8は100万トークンコンテキスト対応
6月中旬
発表事項企業内容
Anthropic MarketplaceAnthropic新機能・ツール拡充
Claude動的ワークフローAnthropic中小企業向け実務対応
Computer Use APIAnthropicタスク自動化機能

7月 〜 復帰・拡張・国際展開期

7月1日
イベント企業内容
サービス復帰Anthropic約3週間の停止を経て復帰
Sonnet 5追加Anthropic新ラインナップに加わる
7月16日
モデル企業特徴
Kimi K3Moonshot AI(中国)約2.8兆パラメータ、100万トークン、オープンウェイト史上最大級、7月27日フルウェイト公開予定
NVIDIA Vera Rubin AIファクトリーNVIDIA日本・Noetra連携、フィジカルAI向け国家規模インフラ、経済産業省支援
7月21日-22日
モデル企業特徴
Gemini 3.5 Pro GAGoogle最大200万トークンコンテキスト、一般提供開始
Gemini 3.5 FlashGoogle日本語性能・検索連携で評価高い
セキュリティ特化モデルGoogle複数新モデル発表
ZCodeZ.ai(中国)GLM-5.2ベース、BYOK対応、20種類以上ツール連携、月額$16~
モデル企業特徴
Hunyuan T1Tencent(中国)OpenAIの10分の1コストで2倍速度
Qwen2.5-Omni-7BAlibaba(中国)マルチモーダル、モバイル効率処理

生成AI最新情報

速報!OpenAIがGPT-4o-mini-ttsをリリース。日本語対応し、音声文字起こしやテキスト読み上げ。

2025年3月21日

OpenAIが開発したGPT-4o-mini-ttsは、高性能なTTS(Text-to-Speech)モデルです。このモデルはテキストを読み上げる際に、自然なイントネーションや感情表現を加えることができます。従来のTTS […]

動画生成AI Wan2.1

2025年3月2日

アリババクラウド(中国のネット通販大手アリババグループの一員)が、画像や動画を生成するAIの基盤モデル「Wan2.1」をオープンソース化することを発表しました。 この取り組みによりサービスなどの利用がさらに広がることを目 […]

生成AI-Blog

タイトルとURLをコピーしました