SaaSの死という話を聞いて、半信半疑で調べ始めたら確かにそうだった
「SaaSの死」は誇張か現実か。AIエージェントとローカルLLMの台頭で何が変わるかを正直に検証。単機能SaaSから見直すべき理由と、残るSaaSの条件を解説。
この記事の結論(2分で読める要約)
- 「SaaSの死」は誇張だが、AIエージェント統合によって一部のSaaSは価値を失いつつある
- 単機能・高価格のSaaSが最初に代替される。複雑なワークフロー統合SaaSはまだ安泰
- ローカルLLM普及でクラウドAI課金への依存度が下がり始めている
- 月額20〜30ドルのSaaSを複数契約する個人・小規模チームへの影響が大きい
- 「何に課金しているか」を整理する機会が来ている
情報の鮮度: 2026年2月時点の観察をもとに記述
「SaaSの死」という言葉が一時期よく聞こえた。
誇張だと思っていたが、半年経って確認してみると、いくつかの点では現実になっていることに気づいた。
何が変わりつつあるか
月額で課金していたSaaSのうち、AIエージェントで代替できるものが出てきた。
具体的には、単機能のデータ変換・フォーマット変換ツール、ライティング補助ツール、簡単なデータ分析ダッシュボードなどだ。これらは、Claude + 適切なプロンプトで同等の出力が得られるケースがある。
ただし「全部AIで代替できる」は間違いだ。Salesforce・Notion・Figmaのように、複数人のワークフローが統合されたSaaSは、AIが単純に置き換えられるものではない。協調とストレージとUIが一体になっている。
ローカルLLMとコスト構造の変化
もう一つの変化は、ローカルLLMの現実的な選択肢としての台頭だ。
月額20〜25ドルのAPIサービスを複数契約する代わりに、自前のサーバーでOllamaを動かし、Llama 3やQwen 2.5を使う。初期費用はかかるが、ランニングコストはほぼ0になる。プライバシーの問題も解消される。
この選択が現実的になったのは、2024〜2025年にかけてモデルの品質が急改善したからだ。2年前のローカルLLMはおもちゃに近かった。今は実用に足る。
どのSaaSが危ないか
| リスク | 分類 | 理由 |
|---|---|---|
| 高い | 単機能ライティング補助 | Claude等で代替可能 |
| 高い | 簡単なデータ整形・変換 | スクリプト+LLMで対応可 |
| 低い | CRM(顧客データ統合) | 複数人協調・履歴が価値 |
| 低い | デザインツール | UI/UX協業・コンポーネント管理 |
| 低い | プロジェクト管理 | チームの状態管理が本質 |
判断基準は「その機能に人間の協調が必要か」だ。一人で完結する作業をSaaSに課金しているなら、AIで代替を検討する価値がある。
FAQ
Q: SaaSへの課金を全部やめてもいい? A: やめるべきではない。複雑なワークフロー統合・チーム共有・履歴管理はSaaSが依然として強い。「一人で完結する単機能SaaS」から見直すのが現実的。
Q: ローカルLLMはどのスペックのPCが必要?
A: 7Bモデルなら8GB VRAM(RTX 3060以上)で動く。70B規模は24GB以上必要。詳細は
BlogOllamaでローカルにチャットを住まわせた記録 — インストールからモデル選びまでOllamaを使ってローカルLLMを動かした実録。インストール手順・VRAM別モデル選び・実際に使って感じた正直な評価まで。RTX 4070 Ti(12GB)環境での体験ベース。→で確認できる。
Q: 企業のSaaS導入判断はどう変わる? A: AIエージェント統合の可否が選定基準に加わっている。API提供のないSaaSは選択肢から外れ始めている。
SaaSが「死ぬ」かどうかより、何に課金し続けるかを問い直す時期が来ている。
毎月引き落とされているあの請求、本当に必要か。その問いだけは残る。
関連:
BlogOllamaでローカルにチャットを住まわせた記録 — インストールからモデル選びまでOllamaを使ってローカルLLMを動かした実録。インストール手順・VRAM別モデル選び・実際に使って感じた正直な評価まで。RTX 4070 Ti(12GB)環境での体験ベース。→ |
BlogローカルAI vs クラウドAI、2026年の今どちらが本命なのかを正直に語る2026年のAI環境の中で、ローカルAIとクラウドAIのメリット・デメリットを徹底比較。コスト、プライバシー、性能、手軽さを管理人の視点で解説します。→ | AIワークロード一覧
関連記事
Blog【速報・完全版】Gemini 3.1 Pro徹底解説 — 推論2倍超・思考シグネチャ・エージェント時代の幕開け2026年2月19日リリースのGemini 3.1 Proを完全解説。ARC-AGI-2で77.1%(前世代比2倍超)、SWE-bench 80.6%を達成。Thinking Levels・思考シグネチャ・Context Caching最大90%削減・Batch API・Google Antigravityなど、開発者が知るべき全機能をベンチマーク比較表・料金表・プロンプト例付きで徹底解説。→
BlogClaude Code の新effortモード徹底解説|max・ultracode・autoと『呪文ultrathink』の正体Claude Code の /effort に増えた max・ultracode・auto と、プロンプトに紛れ込ませる呪文 ultrathink を、公式が明言した『ultracode は API の effort レベルではない』を起点に解剖。overthinking・自律ワークフロー・永続性と優先順位の罠まで、誤解されやすい論点を一次情報で正します。→
BlogClaude Code の /effort 完全ガイド|low〜maxの使い分けと『コストが増える本当の理由』Claude Code の /effort(low〜max・ultracode・auto)は「賢さ」ではなく「トークンの気前よさ」のレバー。モデル別の推奨スタートと、Opus 4.8 でコストが増えた気がする原因を『トークナイザ』と『effort』の2軸に切り分ける考え方を、公式一次情報と v2.1.156 の実機確認で解説します。→
関連リンク
- 実際の構成を探すなら、GPU 比較ページやローカルLLM向け構成記事もあわせて見ると判断しやすいです。
- ハードウェア候補は用途別の AI 構成ガイドからたどると、単体製品より違和感なく検討できます。
この記事を書いた人
HW系エンジニアとして20年以上、10,000件を超える顧客訪問と2,000件を超える単独ソリューション実績。AIツールを使った個人開発やIoT農園など、Raspberry Piを使ったオートメーション化なども実践中です!エンジニア専門結婚相談所も運営中、ClaudeCodeで解決できない心の課題も解決いたします!
関連記事
AIに発言だけ見せて「この2体は誰だ」と聞いたらGeminiを当てた。でも根拠はこちらのバグだった
AI同士に正体を伏せたまま20回会話させ、その発言ログだけを第三のAIに渡して「同じモデルか、どちらが上か」を推理させました。正体は当てましたが、根拠にはこちらの設定ミスが混ざっていました。同じ勝負を2回撮って分かったことの全記録です。
スマホだけで英語YouTubeを同時通訳:Gemini 3.5 Live Translateを耳で使う実践メモ
2026年6月公開のGemini 3.5 Live Translateを、スマホとBluetoothイヤホンだけで実機検証。スピーカーだと待たされるのにイヤホンだとほぼ完璧な同時通訳になる——その分かれ目と、英語YouTubeを耳で理解する一番実用的な使い方を共有します。
Google Gemma 4が変えたこと——Apache 2.0と本格マルチモーダルで「使えるオープンモデル」の基準が上がった
Google DeepMindが2026年4月にリリースしたGemma 4の実力を整理する。Apache 2.0への変更、E2B〜31Bの4モデル構成、画像・動画・音声対応のマルチモーダル実装、そしてQwen 3.5やDeepSeek V3.2との比較まで。「ローカルで動かして本当に使えるか」という目線で書く。
危険なツールを薦めたAI執事が5分後にセキュリティ講座を開いた
AIの推薦を安全承認と勘違いすると危ない。実体験の後日談から、推薦・検証・判断を分ける運用とdry-runの使い方を整理します。
META-MARK × AI
ローカルAIを動かすGPU、ちゃんと選べていますか?
VRAM・性能・コスパをMetaScoreで数値化。AIアプリ別の推奨ハードウェア要件も確認できます。
PR広告:開発環境・キャリアまわりのサービス