利用中のAIサービスが増えてきたので記録する(2025年5月)
OpenAI、Microsoft、Meta、Google、Anthropic…とビッグニュースが連発され、落ち着かない月だったので現時点の備忘録。年末にはまた入れ替わっている可能性もありそう。
仕事用
ChatGPT
調査、システム仕様検討、コーディング
ざっとした調査、相談は年初からは4oを使用。 コーディングについては一時期はo1を併用しており、その性能に感動していた。 とはいえコスト面で、最近は推論が必要なタスクについては、o3を使用している。 WebサービスにAPIを組み込むなどもしていた。
Claude
調査、文書清書
Sonnet3.7の頃から、草稿を貼りつけて清書してもらう。案だけ渡して書いてもらうのでも成果物の質が良かった。AI楽曲の歌詞の手直しにも向いている。
システム仕様検討、コーディング
4.0系になると「ClaudeCode」がnodeパッケージとして提供されるようになり、VibeCoding勢がそのパフォーマンスにざわついた。 Github Actionsにアプリ連携しておくと、Githubアプリから実装指示できるようになったのは衝撃だった。
Gemini
システム仕様検討、コーディング
2.0系ではイマイチだったのが、2.5系になってからは信頼度が増した。メインはClaude4.0で、回答に納得できない場合にGeminiにも投げるような併用。
エコシステム
Google I/Oのイベントが圧倒的だった。AIのパフォーマンスだけでなく、GoogleCloudとの連携を活かしたプロダクト発表や、動画生成サービスの提供拡大、XR領域へのサービスデモなど。 いままでは静観していたけど、急にアクセルを踏んできた印象を受けたし、インフラ/OS/ハードウェア/ソフトウェアの領域横断で、GoogleのAIサービスが一気に広がるような予感もした。
エディタ
年初からCursorを使っていた。AIエージェントのモード切替やMCPなど、先進的な機能が搭載されていたため。
ClaudeCodeを触ってみるとGithub Actions連携が良かった。@claude のようにエージェント指示することでIssueが立てられる、順に実装を進めてくれるといったことも実現できるようになった(スマホアプリから実装依頼出せる)ので、開発環境については柔軟判断していきたい。
趣味用
Midjourney(兼にじじゃーにー)
画像生成
後続のSUNOと併せて使っている。
画像生成した画像をCanvaに取り込んで、KindleのKDPで出版もしてみた。

2025年4月にバージョンv7となった。v7の画像は、v6のそれよりリアル感が増した。 動画生成サービスがスタート地点の描写画像をインプットできるので、観測範囲ではMidjourneyで出力した画像を起点に動画生成するような用途が多い。
SUNO AI
音楽生成
類似サービスにUdio、GoogleのMusicFXがあるが、もっぱらSUNOを使っている。
Hedra
音楽生成
画像をもとに、音楽動画用にリップシンクさせるのに相性が良かった。 生成時間を30秒くらいにして、YouTube ショートにアップするような使い方をした。
深堀りたい
Google AI Studio
アプリ生成からデプロイ
CloudRunデプロイまで自動化されているようでサービス提供のハードルが下がるのはVibeCodingするにもメリット大。
Google A2A
エージェント間の連携
作成したAIエージェントどうしを連携させたいといったニーズは出てきそう。
様子見
Kling、Veo…その他動画生成
どのサービスも、5~10秒ほどを生成できる。出力内容もより高品質になったし、継ぎはぎしてアニメやCMを制作するひとも現れてきている。 Kling2.1が頭一つ突出しているが、GoogleのVeo3が怒涛の追いかけをしてきている。Klingも生成料金減を計ってきたので、先行きは読めないけど。年内目途でどちらかが長時間生成を実現すると、状況が変わるのでなかろうか。
ローカルLLM
また動画生成であれば、今年はWanやFramePackなるOSSが出てきて、商用サービスに引けを取らない状況。 Qwen、GemmaのようなローカルPCで動作する(要GPU)LLMも性能が伸びてきているのでエッジコンピューティング領域もよりAIの恩恵が受けれそう。
と、ざっと上げたのでも追跡する情報量が多く、Xのタイムラインを眺めているとAI疲れをつぶやくひとも散見されている。
トレンドが加速しているので、モデル変化で変わらないもののを選定してから触るようにする。