カテゴリ: ai-log
-
7:00に頼んで、7:00 / 7:25 / 7:34に来た。Gemini Sparkに毎朝の巡回を3日間任せた記録
Googleの常駐AIエージェント「Gemini Spark」に、毎朝7時のニュース巡回を3日間任せた実測記録。実行時にPCが起動している必要はなく3日とも動いた一方で、実行時刻は7:00 / 7:25 / 7:34とばらつき、要約からは原文の数値や留保が抜け落ちていた。自前のスケジュール実行と何を交換したのか。
-
8語で作らせたアプリを、同じAIが操作して対局した。Cloudflare OSを無料で試した記録
CloudflareがOSS公開した社内AI基盤「Cloudflare OS」を、Windowsのローカル環境で起動してGadget生成からAIとの対局まで試した記録。動かすまでに落ちた4箇所、ローカルLLMで代用できなかった実測、そして「無料で試せるか」の答え。
-
合計159万再生のAI文章術と、閲覧34の自分のサイトが、同じ仕組みでできていた
XでバズっているAI文章術の投稿3本を読んだら、そこで説かれている「文章OS」(ルールのファイル化・手順のスキル化・校閲の分離・機械検査)は、自分が記事制作パイプラインとして運用している構成そのものだった。仕組みの実物と、投稿には書かれていない側の実数(閲覧34・成果0件)を開く。
-
一番古く見えたのは自分の広告だった。触れないコードを触らず直す
自分のブログを別のAIにデザイン監査させたら、最優先の指摘が「広告だけ古く見える」だった。ただし楽天のリンクコードは改変できない。コードに1文字も触れず、外側のCSSだけでモバイル表示を直した記録。
-
実装をAIに任せ、レビューもAIに任せたら、見た目のズレだけが残っていた
このブログの改修を、設計と実装で別のAIに分担させた記録。テスト131件は全部通り、完了申告も全部本当だったのに、設計したAIのレビューで見た目のズレが1件見つかった。仕様の字面と意図の話。
-
AIに実装を丸ごと任せたら、テストは通ったが画面は誰も見ていなかった
自作アプリの縦書き機能をAIに計画書1本で実装委任した記録。テストは174件から180件に増えて全部通ったが、描画を確かめるテストは0件だった。計画書に指示した説明コメントも1件落ちた。
-
AIへの指示書を72%削ったら、5つのファイルでルールが食い違っていた
AIに毎回読ませていた指示書18.3KBを5.2KBに整理した記録。削減の大半は不要になったファイル1本の切り離しで、途中で自分のルールの矛盾が5ファイル分見つかった。効果はまだ検証していない。