本ページは AI Safety for Mathematicians の非公式日本語訳です ─ このページの原文を読む ↗

数学者のためのAIセーフティ

きわめて高い視点からの入門リソース

AIセーフティ(AI safety)に取り組みたい数学者のための出発点。

このサイトの目的

このサイトは、数学者がAIセーフティの仕事に関わるための、きわめて高い視点から書かれた入門リソースである。私たちは次のように考えている:

  1. AIは、今後数年のうちに社会へ多大な影響を及ぼそうとしている。
  2. それに伴って多くの新しいリスクが生じ、それらを効果的に管理するには、より多くの取り組みが必要になる。
  3. 数学者が貢献できる機会は数多くあり、その中には数学者が強い比較優位を持つものもある。

これは誰かを型にはめようとするものではない。数学者も数学者でない人も多様なスキルと関心を持っており、このサイトがより広い層の人々の役に立つなら、それは喜ばしいことだ。ただし想定読者は、AIセーフティに関わろうとしている職業数学者である。

AIセーフティとは何か?

AIセーフティは、AIシステムが人間にとって悪い帰結をもたらさないようにするにはどうすればよいかを問う。AIアラインメント(AI alignment)は、そうしたシステムが人間の価値観と両立するしかたで行動する──あるいは行動しようとする──ようにするにはどうすればよいかを問う。

これらの分野は、まだ厳密に定式化されていないヒューリスティックな概念の集まりで構成されていることが多い。仕事の多くは、曖昧な概念を定式化し、適切な理論的枠組みを見つけることにある。

  1. AIが何をしているのかを、どうすれば理解できるか?
  2. AIシステムが私たちと、また互いに協力するようにするには、どうすればよいか?
  3. AIが嘘をついたり画策したりしていないかを、どうすれば見分けられるか?

研究の方向性

数学者に向けて、いくつかの研究の方向性をきわめて高い視点から解説する。各解説の末尾には、さらに探究するためのリソースを掲載している。この一覧は今後拡充していく予定であり、それぞれの解説も(おそらく良い方向に!)変わりうる。

(研究の方向性は、今後さらに追加予定!)