回帰テスト
多ターン追跡・危険度フロア・台帳記録を担保、全件パス
Loading project...
設計者・実装者・運用者(単独)
1人(調査・実装・レビューはAIエージェントチーム)
4日間のスプリント:2026-09-25にv2再設計 → 09-26に3モード仕様確定 → 実機検証 → 09-28に提出
第5回 Agentic AI Hackathon with Google Cloud への2作目の提出物です。年間700億円超(2024年・警察庁)の被害を出す特殊詐欺 — 被害者の多くは完全に騙されていたわけではありません。薄い違和感を持ちながら止まれなかっただけです。sagi-shieldは、その瞬間に押す「秘書ボタン」です。ボタンを押すと、AIが「私はAIの防犯秘書です」と必ず名乗ってから、相手の氏名・所属・代表番号・用件を検証 — Gemini Live APIによる実通話での音声応対が本番環境で動作確認済み。全応対は証拠台帳に記録され、危険判定時は家族へLINE通知、警察相談(#9110)用レポートも自動生成します。決定的検出層は既知エラー注入で校正済み(検出100%/誤検知0%・テストコーパス)。
詐欺の被害者は「何でも信じた人」ではありません。違和感を持ちながら行動に移せなかった人たちです。「怪しければ切ればいい」が機能しないのは、切るには確信が要り、その確信を通話中の素人が一人で検証できないからです。最初の疑念から助けに辿り着くまでの数分間 — 被害者はそこで訓練された相手と一対一で対峙しています。既存の回答も合いませんでした:家族のLINEや通話を監視する案は同意が取れず、詐欺師を「迎撃」する自動応答は誰も頼んでいない証拠を作るだけです。
監視システムではなく、ボタンにしました。sagi-shieldは人が押すまで何もしません。押した後は実際の状況に合わせた3モード。(1)「AIが電話に代わる」— 固定電話の通話中に相手の声がこのスマホに聞こえる位置に置くだけで、Gemini Live APIのエージェントが「私はAIの防犯秘書です」と名乗り、氏名・所属・代表番号・用件を順に検証。(2)「耳打ち」— このスマホ自体での通話中でも、名乗り・要求をタップするだけで危険度判定と返答文を提示し、相手の動きを多ターン追跡。(3)「番号チェック」— 着信番号の形式(国際/050/非通知)で心構えを表示。外部評判DBを使わず、形式分析であると明示します。さらに怪しい文面を貼り付けるテキスト窓口と、親が普段使うLINEの中で完結するLINE公式アカウントの2つの受け口。全応対は証拠台帳に記録され、危険判定時は登録済みの家族へ会話抜粋・次の行動込みでLINE通知。印刷可能な警察相談(#9110)用レポートも自動生成します。
詐欺の被害者は「何でも信じた人」ではありません。違和感を持ちながら行動に移せなかった人たちです。「怪しければ切ればいい」が機能しないのは、切るには確信が要り、その確信を通話中の素人が一人で検証できないからです。最初の疑念から助けに辿り着くまでの数分間 — 被害者はそこで訓練された相手と一対一で対峙しています。既存の回答も合いませんでした:家族のLINEや通話を監視する案は同意が取れず、詐欺師を「迎撃」する自動応答は誰も頼んでいない証拠を作るだけです。
監視システムではなく、ボタンにしました。sagi-shieldは人が押すまで何もしません。押した後は実際の状況に合わせた3モード。(1)「AIが電話に代わる」— 固定電話の通話中に相手の声がこのスマホに聞こえる位置に置くだけで、Gemini Live APIのエージェントが「私はAIの防犯秘書です」と名乗り、氏名・所属・代表番号・用件を順に検証。(2)「耳打ち」— このスマホ自体での通話中でも、名乗り・要求をタップするだけで危険度判定と返答文を提示し、相手の動きを多ターン追跡。(3)「番号チェック」— 着信番号の形式(国際/050/非通知)で心構えを表示。外部評判DBを使わず、形式分析であると明示します。さらに怪しい文面を貼り付けるテキスト窓口と、親が普段使うLINEの中で完結するLINE公式アカウントの2つの受け口。全応対は証拠台帳に記録され、危険判定時は登録済みの家族へ会話抜粋・次の行動込みでLINE通知。印刷可能な警察相談(#9110)用レポートも自動生成します。
誠実さそのものがセキュリティ機能です。AIは必ず名乗る — なりすましも泳がせもしません。「名乗る→所属確認→連絡先確認→用件確認→台帳保存」の検証プロトコルは、推測で点灯させず、トランスクリプトの実発話から検出して可視化します。台帳はAIが実際に送ったもの・提案しただけのもの・利用者が転記したものを構造的に分離し、通知も「LINE側受理」「ログ記録のみ(未送信)」「失敗」を区別。危険度は単調非減少(一度上がったら後で下がらない) — 一度「危険」になったケースは後続ターンで静かに下げません。そして「抑止」は主張しない:相手の切断理由は検出不能なので、台帳は勝利ではなく事実を記録します。限界も機能と同じページに書きます — 認証のないリンク共有モデルの台帳(URLを知る人は閲覧可能)、実験的なスピーカーフォン経路、8,000字の転写上限。
実通話で、Gemini Live APIのエージェントが「私はAIの防犯秘書です」と切り出してから、相手の氏名・所属・代表番号・用件を順に検証。暗証番号や振込の要求には応じません。電話スピーカー→スマホマイク→Live API→音声応答の音響経路は本番環境で検証済みです。
怪しい電話が今手に持っているスマホでの通話中という一番難しい場面では、マイクは当てにできません。耳打ちモードはタップだけで動きます — 名乗り・要求を選ぶだけで危険度判定と返答文を提示し、相手の次の動きを多ターンで追跡します。
全応対はタイムスタンプと判定根拠つきで記録され、危険判定時は登録済みの家族へ会話抜粋・次の行動込みでLINE通知。警察相談専用電話#9110に持ち込める印刷可能なレポートを自動生成します。
3つの通話モードに加えて、怪しい文面(SMS・メール・LINE等)を貼り付けて判定するテキスト窓口と、文面をそのまま転送できるLINE公式アカウントを用意 — 親世代が普段開いているアプリの中で完結します。
最初の設計は証拠で潰しました。旧案(家族LINEの監視・詐欺師への迎撃)は6本のDeep Researchで同意面・効果面とも全滅と確定し、「秘書ボタン」— 監視を選ばず任意の関所 — へ再設計。事業設計成果物(前提整理・構造破壊・フォース・仕様)を実装に先行させ、各ゲートで敵対的レビューを通しました。実機検証では本番環境で音響経路を確認 — AIが名乗り・所属確認・暗証番号要求の拒否・公式番号へのかけ直し助言まで行い、危険判定とLINE通知が発火した実応対記録が残っています。検出層は既知エラー注入(名乗り削除・緊急性削除・要求の弱体化・正常化)による合成コーパスで校正し、79%という最悪ケースを含む実測値を丸めずに公開しています。2026-09-28に提出。
多ターン追跡・危険度フロア・台帳記録を担保、全件パス
決定的パターン層:検出率100%(詐欺コーパスn=24)・誤検知0%(正常文n=11)。最悪摂動79%は既知の限界として公開 — LLM判定層の品質は別計測
電話スピーカー→スマホマイク→Gemini Live API→AI音声応答を本番環境で確認。実応対の記録あり
証拠による全滅後のv2再設計 → 仕様 → 実装 → 実機検証 → 提出

入口 — 怪しい文面をLINE公式アカウントへ転送するか、ブラウザで文面を検証。音声窓口は技術デモと明示