FUJILOG

見た、聴いた、触れたこと。 動かしたもの、書いたもの。 ウェブとリアルの備忘録です。

利用中のAIサービスが増えてきたので記録する(2025年5月)

OpenAI、Microsoft、Meta、Google、Anthropic…とビッグニュースが連発され、落ち着かない月だったので現時点の備忘録。年末にはまた入れ替わっている可能性もありそう。

仕事用

ChatGPT

調査、システム仕様検討、コーディング

ざっとした調査、相談は年初からは4oを使用。 コーディングについては一時期はo1を併用しており、その性能に感動していた。 とはいえコスト面で、最近は推論が必要なタスクについては、o3を使用している。 WebサービスAPIを組み込むなどもしていた。

Claude

調査、文書清書

Sonnet3.7の頃から、草稿を貼りつけて清書してもらう。案だけ渡して書いてもらうのでも成果物の質が良かった。AI楽曲の歌詞の手直しにも向いている。

システム仕様検討、コーディング

4.0系になると「ClaudeCode」がnodeパッケージとして提供されるようになり、VibeCoding勢がそのパフォーマンスにざわついた。 Github Actionsにアプリ連携しておくと、Githubアプリから実装指示できるようになったのは衝撃だった。

Gemini

システム仕様検討、コーディング

2.0系ではイマイチだったのが、2.5系になってからは信頼度が増した。メインはClaude4.0で、回答に納得できない場合にGeminiにも投げるような併用。

エコシステム

Google I/Oのイベントが圧倒的だった。AIのパフォーマンスだけでなく、GoogleCloudとの連携を活かしたプロダクト発表や、動画生成サービスの提供拡大、XR領域へのサービスデモなど。 いままでは静観していたけど、急にアクセルを踏んできた印象を受けたし、インフラ/OS/ハードウェア/ソフトウェアの領域横断で、GoogleのAIサービスが一気に広がるような予感もした。

エディタ

年初からCursorを使っていた。AIエージェントのモード切替やMCPなど、先進的な機能が搭載されていたため。

ClaudeCodeを触ってみるとGithub Actions連携が良かった。@claude のようにエージェント指示することでIssueが立てられる、順に実装を進めてくれるといったことも実現できるようになった(スマホアプリから実装依頼出せる)ので、開発環境については柔軟判断していきたい。

趣味用

Midjourney(兼にじじゃーにー)

画像生成

後続のSUNOと併せて使っている。 画像生成した画像をCanvaに取り込んで、KindleのKDPで出版もしてみた。

2025年4月にバージョンv7となった。v7の画像は、v6のそれよりリアル感が増した。 動画生成サービスがスタート地点の描写画像をインプットできるので、観測範囲ではMidjourneyで出力した画像を起点に動画生成するような用途が多い。

SUNO AI

音楽生成

類似サービスにUdio、GoogleのMusicFXがあるが、もっぱらSUNOを使っている。

Hedra

音楽生成

画像をもとに、音楽動画用にリップシンクさせるのに相性が良かった。 生成時間を30秒くらいにして、YouTube ショートにアップするような使い方をした。

深堀りたい

Google AI Studio

アプリ生成からデプロイ

CloudRunデプロイまで自動化されているようでサービス提供のハードルが下がるのはVibeCodingするにもメリット大。

Google A2A

エージェント間の連携

作成したAIエージェントどうしを連携させたいといったニーズは出てきそう。

様子見

Kling、Veo…その他動画生成

どのサービスも、5~10秒ほどを生成できる。出力内容もより高品質になったし、継ぎはぎしてアニメやCMを制作するひとも現れてきている。 Kling2.1が頭一つ突出しているが、GoogleのVeo3が怒涛の追いかけをしてきている。Klingも生成料金減を計ってきたので、先行きは読めないけど。年内目途でどちらかが長時間生成を実現すると、状況が変わるのでなかろうか。

ローカルLLM

また動画生成であれば、今年はWanやFramePackなるOSSが出てきて、商用サービスに引けを取らない状況。 Qwen、GemmaのようなローカルPCで動作する(要GPU)LLMも性能が伸びてきているのでエッジコンピューティング領域もよりAIの恩恵が受けれそう。

と、ざっと上げたのでも追跡する情報量が多く、Xのタイムラインを眺めているとAI疲れをつぶやくひとも散見されている。

トレンドが加速しているので、モデル変化で変わらないもののを選定してから触るようにする。