Google 對Gmail 的垃圾郵件過濾功能進行了大幅升級,據報道是最先進的之一多年來防禦能力顯著增強。新系統名為RETVec(彈性且高效的文字向量化器),旨在對抗“對抗性文字操作”,這是一種複雜的垃圾郵件形式,使用不同的字元和內容字體以繞過傳統過濾器。

了解對抗性文字操作

垃圾郵件中的對抗性文字操作包括使用同形文字、特殊字元、表情符號和拼字錯誤,可能會逃避傳統垃圾郵件過濾器的偵測。此類別訊息使用大量Unicode 標準中的字符,類似於常見的字母表字母,但先前用於垃圾郵件檢測的人工智慧模型並未將其分類。

問題的核心是,在人眼看來,這些訊息看似常規文本,但卻是令人困惑的Unicode 數組與預期模式不匹配的字元。例如,使用零代替“O”、粗體數學符號代替實際字母,或不尋常的下劃線字元可能會影響模型準確識別和過濾垃圾郵件的能力。

RETVec 的機制

RETVec 建立在一種新穎的字符編碼器之上,能夠有效地編碼所有 UTF-8 字符和單詞,這直接解決了早期系統的局限性。谷歌透露,RETVec 的工作原理是視覺“相似性”,而不是依賴固定的詞彙量或同形字查找表,後者會佔用大量資源。本質上,這使得新系統能夠解釋文本的預期含義類似於人類閱讀的方式。

根據Google 的說法,RETVec 以相對緊湊的方式完成了這些任務,僅包含200,000 個參數。這種效率的影響是巨大的,使得在本地部署該技術成為可能未來的設備。此外,設計效率不會以犧牲性能為代價。Google 的內部測試表明,用RETVec 替換Gmail 之前的文本向量化器可將垃圾郵件檢測率提高38%,並將誤報率降低19.4% ,同時大幅削減模型TPU 使用率提高了83%。

開源RETVec 融入了Google 提高整體互聯網安全性的更廣泛戰略。它符合該公司營造協作環境的精神,讓開發人員可以為開發人員做出貢獻並利用該技術來對抗同形文字攻擊不僅限於Gmail,還跨各種平台。

RETVec 已整合到Gmail 中,致力於保護用戶收件匣免受複雜的垃圾郵件攻擊。 Google 在垃圾郵件過濾技術方面的不斷進步證明了他們對安全性和使用者體驗改進的持續承諾。

Google 在Gmail 中持續採取的反跨度措施

Google今年一直在加強 Gmail 的反垃圾郵件功能。十月份,該公司更改了有關批量寄件者的規則以打擊垃圾郵件。根據新指示,Google 將強制執行特定的垃圾郵件率,批量電子郵件發件人必須遵守​​該規定。雖然 Gmail 目前建議垃圾郵件輸出量低於 0.3%,但這些新規定將此建議轉化為具體規則,旨在減少堵塞用戶收件匣的垃圾郵件量。

Categories: IT Info