データセンター
AIのビッグデータのためのデータセンターの必要性が取り沙汰されている。しかし、日本では環境的な要因から、設立の困難さも言われている。その議論の中から、世界中にはネットワークで繋がっているデータセンターがあるのだから、それを使えばいいという議論もある。
話は変わる。研究生活の最後にプラナリアを使っていた。様々なモデル動物に比べたらプラナリアの研究人口はかなり少ないので、おそらく一つの大学に設置されたデータベースを世界中のプラナリア研究者は当時利用していた。私がプラナリアを利用したいと思った唯一の理由は幹細胞と分化細胞の「近さ」である。幹細胞が唯一の分裂細胞であり、一旦分化を始めたらそれは最終分化であり、分化はすなわち老化して死に至る過程であるというプラナリアの特性に興味を持ったからである。私たちのアイデアは、この欄で何度も書いている、「分裂中は分化できず、分化するためには分裂を止めなければならない」である。この仮説を証明する材料としてプラナリアに着目した。さて、プラナリアの遺伝子の情報を得るには、上述のデータベースにアクセスするしかない。ここに幾つかのキーワードを入れて遺伝子情報を獲得するわけである。日本の特定のアドレスから「細胞周期」「分化」に関する幾つかのキーワードが検索される。もっと具体的には、いくつかの遺伝子名を検索する。従来の考え方では、互いに何ら関係がなさそうに見える複数の遺伝子が、同一の研究者から検索されることになる。この情報をデータベースを運営している研究室が知ることができたら、我々が何に興味を持って研究しようと考えているかを推測できる可能性が広がる。これが怖いと感じた。
同様に捉えて構わないかどうかは知らないのだが、AIで用いるビッグデータベースを外国に依存した場合、そこにアクセスする情報は、すべてデータベースを運営している団体に筒抜けとなる。軍事でも経済でも政策でも、なんでも構わないが、何かについて検索した事実は秘密にはできない。これを恐ろしいと思うのは、考えすぎなのだろうか?