最近、Gmailの「迷惑メール」を開くと、ちょっと感心する。
カード会社、通販、宅配便、銀行を装った詐欺メールが、かなりの割合できれいに捕まっている。しかも昔のような「日本語を見れば一発で分かる」ものばかりではない。生成AIまで使える時代なのだから、文章だけならむしろ本物らしくなっている。
それなのに、なぜGmailにはバレるのか。調べてみると、そもそも人間とGmailでは「メールを見る場所」がかなり違っていた。
Gmailは「怪しい文章」だけを読んでいるわけではない
Googleによると、Gmailの迷惑メール判定には機械学習が使われ、メール本文だけでなく、送信元IPアドレス、ドメインやサブドメイン、送信者認証、ユーザーからのフィードバックなど、複数のシグナルが利用されている。
つまり人間が「この日本語、なんとなく怪しい」と読む一方、Gmailは「誰が、どこから、どんな身元証明で送ってきたのか」まで見ている。
AI生成による概念イメージです。Gmailの実際の画面・設備・内部システムを再現したものではありません。
代表的なのがSPF、DKIM、DMARCと呼ばれるメール認証だ。かなり乱暴に言えば、SPFは「このサーバーから送っていい」、DKIMは「途中で改ざんされていないことを電子署名で確認」、DMARCは「差出人として名乗っているドメインと認証結果がちゃんと整合しているか」を見る仕組みである。
文章が本物そっくりでも、差出人の身分証明がおかしければ怪しまれる。詐欺メール側からすると、国語の試験だけ満点を取っても通れない。
世界中の「迷惑メール報告」も判定材料になる
もう一つ強いのが利用者の数である。Gmailでメールを「迷惑メールとして報告」すると、そのコピーがGoogleへ送られ、迷惑メールや不正行為の検出改善に使われる場合がある。Googleも、報告が増えるほど類似メールをより効率的に迷惑メールと判断できるとしている。
新しい詐欺メールが一斉送信された場合、最初の何人かには届いたとしても、世界中で「これは詐欺だ」と報告が積み上がれば、後続の判定材料が増えていく。
一人では見抜けなくても、Gmail全体では巨大な口コミ網を持っているようなものだ。
文字を細工して機械をだます手口にも対抗している
迷惑メール業者も昔から黙って捕まっていたわけではない。アルファベットに似た別文字を混ぜたり、見えないUnicode文字を挟んだり、無関係な単語を大量に入れたりして、文章判定をすり抜けようとしてきた。
そこでGoogleは2023年、Gmailの迷惑メール分類に「RETVec」というテキスト処理技術を導入したと公表した。
Googleの検証では、それまでの方式と比べてスパム検出率が38%改善し、誤検出率も19.4%減少したという。
ここで注意したい。「全迷惑メールの38%を新たに発見した」という意味ではない。あくまでGoogle内部で比較した従来方式からの改善率である。
1日150億通。秒にすると約17万通だった
Googleは2026年、Gmailでスパム、フィッシング、マルウェアの99.9%以上が受信トレイへ到達するのを防ぎ、1日に約150億通の不要メールをブロックしているとしている。
150億通÷8万6400秒で計算すると、平均で1秒あたり約17万4000通になる。
もちろん世界中のGmailを合計した数字だが、この規模になると、一通一通の文章を単純に「怪しい単語があるか」で判定するだけでは無理がある。送信元の評判、認証、利用者からの報告、本文の特徴などをまとめて機械的に評価する理由がよく分かる。
AI生成による概念イメージです。約17万4000通/秒は、Google公表の「1日約150億通」を8万6400秒で割った単純平均であり、瞬間的な実測値ではありません。
しかも2024年から「送ってくる側」にも厳しくなった
最近よく捕まるように感じる理由を、フィルターの進化だけに決めつけることはできない。ただし、この数年で入口のルール自体が厳しくなったことは事実だ。
Googleは2024年2月1日から、個人向けGmailへメールを送る送信者にSPFまたはDKIMなどを要求。1日5000通を超える大量送信者にはSPF、DKIM、DMARCなどを求め、迷惑メール報告率についても厳しい基準を設けている。
つまり現在のGmailは、怪しいメールが届いてから選別するだけではない。「そもそも、まともな送信者として振る舞っているか」という入口でもふるいにかけている。
では、もう詐欺メールは怖くないのか
残念ながら、そこまで単純ではない。
Gmailが送信元や評判まで見るなら、攻撃側は乗っ取った正規アカウントや信頼されているサービスなどを悪用しようとする。実際、Google自身も連絡先に登録済みの相手から突然迷惑メールが届いた場合、相手のアカウントが不正使用されている可能性を案内している。
そして99.9%という数字も「詐欺メールだけの検出率」ではなく、Googleが示しているのはスパム・フィッシング・マルウェアを合わせた値である。受信トレイに入ったから本物、という保証にはならない。
【編集者が思うこと】
昔の詐欺メールは、人間のほうが有利だった。「日本語がおかしい」「銀行がそんな言い方するか」で結構見抜けた。
ところが今は、文章ならAIでいくらでも整えられる。普通に読んだだけでは、本物との差がどんどん小さくなっている。
そこで面白いのが、Gmailは逆に文章だけの勝負から降りていたことだ。IPを見る。ドメインを見る。身元証明を見る。過去の評判を見る。そして世界中の人間が押した「迷惑メール」ボタンまで見る。
結局、詐欺師が一番うまい文章を書けるようになっても、「お前、その手紙をどこから持ってきたんだ?」と聞かれたところでボロが出る。
最近Gmailが妙に優秀に感じる理由は、文章を読むAIが賢くなっただけではない。メールそのものではなく、メールの「素性」まで見る仕組みが成熟してきたからと考えたほうが、実態には近そうだ。
参考資料
- Google Workspace Blog「Gmail の迷惑メールフィルタを理解する」(2022年5月27日)
- Google Online Security Blog「Improving Text Classification Resilience and Efficiency with RETVec」(2023年11月29日)
- Google Gmail ヘルプ「メール送信者のガイドライン」
- Google Gmail ヘルプ「Gmail で迷惑メールを報告する」
- Google「Our fight against fraud: 5 ways we’re keeping you safer」(2026年5月13日)
- Google「Google’s June 2026 frauds and scams advisory」(2026年6月)
