生成AIの記事は成功談ばかりが目立ちます。この記事は逆に、当サイト運営者が実際に生成AIを仕事で使って困ったこと、うまくいかなかったこと、まだ解決していないことをまとめたものです。運営者の環境・使い方における実例であり、生成AI全般の欠陥として一般化するものではありません。「AIは危険」と煽る記事ではなく、安全かつ効率的に使うために実体験から分かったことを伝える記事です。なお、運営者が使い分けているChatGPTとClaudeの違いはChatGPTとClaude、仕事で使うならどちら?で比較しています。
失敗1:ChatGPTが指示していない変更をした
不動産会社でChatGPTを使っているケースです。チラシやホームページの制作をChatGPTに支援させる中で、ロゴを勝手に変更する、電話番号を変更するといった、指示していない変更が出力に含まれていたことがありました。
このため、生成物をそのまま使わず、人間が完成前に内容を確認する運用にしています。詳しい経緯は不動産会社でChatGPTを仕事に使って分かったことにまとめています。
失敗2:作った仕組みが、まだ実務で十分活かせていない
Claude Codeを使って顧客データベースを制作したケースです。紙とExcelでの管理から切り替えるつもりでしたが、この顧客データベースは、現時点では実業務に十分活用できていません。
「作った」ことと「業務が改善した」ことは別だと分かる例です。一方で、同じくClaude Codeで作った別のメールリストは、営業メール送信の場面で活用されています。作ったものすべてが役に立つわけではない、という実感です。詳しくはClaude Codeに会社の仕事を任せてみたにまとめています。
失敗3:AIが本来の目的から外れて作業を進めた
Instagram投稿を自動化する仕組みを作っていたときの経験です。自動化の目的は「投稿できる状態にする」ことでしたが、構築の途中、AI側が本来の目的よりも必要性の低いシステム改良を進める場面がありました。
これに気づいた本人が、「まず投稿できる状態にすることを優先する」ように軌道修正しています。AIに作業を任せるときは、本来の目的から外れていないかを人間が都度確認する必要がある、という実例です。詳しくはInstagram投稿をAIで半自動化して約60分→約5分になった実例にまとめています。
課題:AIにAIをレビューさせる運用にも、見落としの余地がある
ChatGPTに企画・設計を任せ、Claude・Claude Codeでの実装結果をChatGPTに確認させる運用(詳しくはChatGPT・Claude・Claude Codeをどう使い分けているか)を続ける中で見えてきた教訓は、「AI同士に確認させれば人間の確認を減らせる」という考え方には限界がある、という点です。AI間のやり取りを人間がすべて細かく読んでいるわけではないため、意見の食い違いや、本来不要なやり取りが起きていても気づきにくいことがあります。運営者自身、「慎重になりすぎているかもしれない」と感じる場面もありますが、それでもこの慎重さを保っているのは、技術的な内容をすべて自分で判断する負担の方が大きいと感じているためです。どこまで人間が確認し、どこからAI同士に任せるかは、今も試行錯誤の途中です。
これらの経験から分かったこと
3つの失敗と1つの課題に共通するのは、次のような点です。
- 成果物をそのまま使わない。 チラシ・ホームページのように外部に出るものは、完成前に人間が確認する
- 「作った」で終わらせない。 実際に業務で使われているかを後から確認する必要がある
- 目的からのズレに気づく仕組みを持つ。 AIが本来の目的以外の作業を進めていないか、途中で確認する
- AI同士のやり取りも、完全にお任せにはしない。 便利ではあるが、人間がどこまで確認するかを意識しておく
これらは運営者の環境・使い方における実例であり、同じことが起きるとは限りません。ただ、生成AIを仕事に使う際に起こりうる問題の一例として参考になると考えています。
よくある質問
Q. 生成AIを使うのはやめたほうがいいですか? A. この記事はそうした結論ではありません。運営者は失敗を経験しながらも、確認の仕組みを作ることで使い続けています。何を任せ、何を人間が確認するかを決めておくことが大切だと考えられます。
Q. こうした失敗を防ぐ方法はありますか? A. 完全に防ぐ方法を保証するものではありませんが、成果物を人間が確認する、目的から外れていないか途中で見る、といった対応は役立っています。詳しくはAI導入で最初に自動化すべき仕事やAIエージェントとは何かも参考にしてください。
Q. 他にも失敗はありますか? A. この記事は、運営者へのインタビューで確認できた範囲の実例です。今後、新しい失敗事例が確認でき次第、追記します。
まとめ
- ChatGPTが指示していない変更(ロゴ・電話番号)をした経験がある
- Claude Codeで作った顧客データベースは、現時点で実業務に十分活用できていない
- Instagram自動化の構築中、AIが目的から外れた改良を進めたため軌道修正した
- ChatGPTとClaude間のやり取りをすべて人間が確認できているわけではない
- 慎重になりすぎているかもしれない、という自覚もある
- これらは運営者の実例であり、生成AI全般の欠陥として一般化するものではない
あわせて読みたい記事
- 不動産会社でChatGPTを仕事に使って分かったこと
- Claude Codeに会社の仕事を任せてみた
- Instagram投稿をAIで半自動化して約60分→約5分になった実例
- ChatGPT・Claude・Claude Codeをどう使い分けているか
- 小さい会社の仕事をAIにどこまで任せるか
根拠・出典
この記事で紹介している失敗・課題は、運営者本人へのインタビュー(2026年9月22日・23日実施)をもとにしています。運営者の環境・使い方における実例であり、生成AI全般の傾向として一般化するものではありません。

コメント