会話アクティビティによるトレーニング”がオンの場合なので個人用のCopilotの場合ですね。
Microsoft Privacy Statementで、個人情報はモデル学習に使われない、内容そのものを保存・再利用しない、データは目的外利用されない、ということになっているので、Copilot利用者の利用傾向のパターンは学習されるが、著作物そのものを学習するのではない様ですが、学習されたかどうかで訴えが起きるとすれば、被告はMicrosoftの構図になるのでしょうね。学習されないことを立証できれば(立証できるでしょうから)問題なしでしょうね。
アウトプットが侵害と訴えられたら、アウトプットで利益が生じるかもしれないCopilot利用者が訴えられる構図ですので、これはやばい、ということになりますね。ですので著作物を個人用Cpilotで扱ってはダメ、ということですね。
ちなみに、
組織用のCopilotの場合は・・・
EDP(Enterprise data protection)の機能で、
- Copilot は利用者のデータを学習できない(モデル改善パイプラインにデータが流れないため、物理的に学習が不可能)
- Copilot は他テナントのデータを参照できない(Graph API のアクセスは自テナントに限定)
- Copilot は機密情報を勝手に出力できない(DLP・情報保護ラベルが出力を強制的に制御)
また、利用者がガードレールを遵守している限り、CCC(Copilot Copyright Commitment 万一、著作権上の異議を申し立てられた場合、マイクロソフトは法的リスクに対して責任を負います)の機能でMicrosoftが矢面に立ちますね
ということなので、著作物を扱うときは、ガードレール等を厳格に遵守して必ず組織用のCopilotで実行するべきでしょうね。(Microsoftが提供するコンテンツフィルターやガードレールを有効にした状態で使い、まさに意図的に著作権侵害コンテンツを生成させないこと、でしょう)