YATA-NODE Blog

Blog

Webデータ収集

「Webデータ収集」タグの記事の一覧です。

権利

AI学習クローラから自サイトを守る — robots.txt/noai/CDNの4段

AI学習クローラから自サイトを守る最低ラインはrobots.txt(RFC 9309)+X-Robots-Tag+noaiメタ+CDNブロックの4段。「止める/意思表示する/証跡を残す」の違いと、ホスト別の実装、fair use・EU DSM指令の訴訟動向を整理する実務ガイド。

続きを読む
権利

スクレイピングの法的境界 — 「AIに調べさせる」前に見極める4観点

スクレイピング(AIにURLを調べさせる行為を含む)の適法性は「合法/違法」で一括では決まらない。著作権(30条の4)・不正アクセス禁止法・個人情報・利用規約の4観点と、robots.txt/規約/認証壁の性質差、岡崎事件を、使う前に見極める実務ガイド。

続きを読む