FI-SC3のRNAseqのデータは何に使われたのか?

学とみ子は当方の「FI-SC3のRNA-seqデータは樹形図に使われた」というコメントに対して「ため息さんのAIは間違っています。学とみ子は取り違えてませんね。ため息さんのAI説明は、✖です。」として、当方の記述「「FI-SC3がLetterで使われた」というのは、**FI-SC3のRNA-seqデータがLetterの遺伝子発現解析(Fig. 2i)に採用された**という意味です。」に取り消し線を付けています。論理的に反論するのではなく「「FI-SC3がLetterで使われた」の意味は、レター論文のOctが光るの写真で使われたと言う意味なのかなと私は想像する。」と学とみ子の想像と違うから誤りだというのです。しかも他人の発言に取り消し線を加えるというのは、たとえ憎きため息が相手とはいえ、相手に敬意を欠く甚だ失礼な行為です。70歳後半のましてや医師という一般にはインテリで良識ある職位にあるとされる方のすることではありません。どんな教育を受けてきたと批判するのには歳を取りすぎています(教育された方々はすでに鬼籍におられるでしょうから批判できない)ので、これまでどんな社会生活を送ってきたのだろうかと言う方が適しています。

 さて、学とみ子はFI-SC3 がLetterの論文に使われたという桂調査委員会報告書の英語版の記述「The FI-SC3 RNA-seq data set which was used in the Letter 」についてChatGPTに質問をしています。質問1:レター論文に使われたという意味は、Fig2iと必ずしも関連しないという読み方ですかね?レターには実際Octが光るFIがありますね。桂報告書英文版がありますが、レター論文に使われたのは混合サンプルだったということですか?Fig2iとの関係について、どう考えますか? そして質問2:レター論文に使われたという意味は、Fig2iと必ずしも関連しないという読み方ですかね?レターには実際Octが光るFIがありますね。です。明らかに質問2は誘導質問です(*1)。したがって学とみ子が得たChatGPTからの回答「その読み方が適切です。ここは**「Letterで使われた」=「Fig.2iの系統樹作成に使われた」ではない**と区別した方がよいです。」はサイコファンシーの可能性が高いのです。さらに質問をつづけた結果(Q2)学とみ子の得た回答は学とみ子の誘導の影響を強く疑わせる回答ということになりました。

一方、当方がFI-SC3のRNAseqのデータがFig.2iの樹状図の構築に使われた、FI-SC3のRNAseqのデータはほかのどの実験にも使われていないという主張に対し、ChatGPTは妥当であると返してきました。そしてこの当方の質問は誘導的かどうか、改めて聞いたところ、誘導的ではないとの回答でした(*2)。

結論:学とみ子の「FI-SC3がLetterで使われた」の意味は、レター論文のOctが光るの写真で使われたと言う意味、FI-SC3のRNA-seqデータがLetterで使われたことは報告書に明記されている、しかし、それがLetter Fig.2iの樹形図に使用されたとは、この英文からは確認できない。 と学とみ子はChatGPTの回答を根拠に主張しているが、その根拠となるChatGPTの回答は学とみ子の誘導的質問の結果であり、根拠とはならず、主張も支持されない。一方、ため息のFI-SC3のRNAseqデータからFig.2iの樹形図が構築されたものであるという主張は、直接記載されてはいないものの、桂調査委員会報告書の英語版から論理的に帰結される主張である。

>学とみ子
感情論ではなく、論理的に反論してみてください。

しつこく、このFI-SC3についてをChatGPTとの質疑応答を通じてまとめたのが*3で、全く同じ質問をGeminiにして得た回答を*4に示します。GeminiにはQ1~Q4 全て同じ質問をしたのですが。回答に変わるところがないのでQ3の回答のみ掲載しました。

*1

Q: 学とみ子さんがSTAP論文のLetterの方で FI-SC細胞のうちの FI-SC3がどの実験に使われたかという議論で質問1:「桂報告書英文版がありますが、レター論文に使われたのは混合サンプルだったということですか?Fig2iとの関係について、どう考えますか?」、質問2「レター論文に使われたという意味は、Fig2iと必ずしも関連しないという読み方ですかね?レターには実際Octが光るFIがありますね。」と質問しています。『質問1はChatGHPTに何の条件も付けてない質問ですから誘導質問ではないですが、質問2は「関連しないという読み方ですかね?」と学とみ子さんの考えの確認を求める質問と「レターには実際Octが光るFIがありますね。」とFI-SC3がOct-GFPがしこまれているので、FI-SC3は蛍光を出す標本に使われているという学とみ子さんの考えを強く押し出した誘導質問で、したがってこの質問のChatGPTの回答は学とみ子さんの意図に引きずられた回答になっている可能性がある。』この学とみ子さんの質問とそのChatGPTの回答の評価は妥当ですか?それともいずれも誘導質問とは評価できないからChatGPTの回答は客観的な見方であると評価していいのでしょうか?簡潔にお答えください。

ChatGPT: はい、前者の評価が概ね妥当です。

– **質問1**:「Fig.2iとの関係について、どう考えますか?」は複数の解釈を許しており、基本的には**誘導質問とは言いにくい**です。
– **質問2**:「Fig2iと必ずしも関連しないという読み方ですかね?」は、すでに特定の解釈を提示して同意を求めています。さらに「レターには実際Octが光るFIがありますね」と、その解釈を支持する材料まで提示しているので、**明確に誘導性があります**。

したがって、質問2を受けたChatGPTの回答については、**その回答だけをもって独立した客観的判断の証拠とするのは適切ではありません**。質問2の提示した解釈に引きずられた可能性を考慮すべきです。

ただし、**誘導質問だから回答内容が必ず誤り、ということではありません**。正否は桂報告書とLetterそのものから独立に検証する必要があります。

Q2: 実際の質問2の回答は「はい、その読み方が適切です。ここは**「Letterで使われた」=「Fig.2iの系統樹作成に使われた」ではない**と区別した方がよいです。」から始まってました([https://katura1.blog.fc2.com/blog-entry-3203.html](https://katura1.blog.fc2.com/blog-entry-3203.html))。さらに「そして、ユーザーさんが指摘された > **レターには実際Octが光るFIがありますね。** これは非常に重要です。」とありますが何故重要なのかの記載はありません。つまりこの回答は学とみ子さんの質問に含まれる学とみ子さんの意見に引きずられたものであるとする評価は妥当でしょうか?それともひきずられていない客観的な回答であるということになるのでしょうか?簡潔にお答えください。

ChatGPT: はい、**「質問に含まれた学とみ子さんの解釈に引きずられた可能性が高い」と評価するのが妥当**です。

特に、

– 質問2が「Fig.2iとは関連しない」という解釈を先に提示している。
– 回答がそれを「その読み方が適切」と直ちに肯定している。
– 「Octが光るFIがありますね」まで「非常に重要」と肯定しながら、**なぜFI-SC3 RNA-seqデータの使用先を判断するうえで重要なのか論証していない**。

という点が重要です。

したがって、この回答を**独立した客観的検討によって得られた結論とみなす根拠は弱い**です。ただし、「誘導されたことが証明された」とまでは言えず、正確には**誘導の影響を強く疑わせる回答**という評価になります。

*2

Q: ため息さんが【 学とみ子さん曰く:『FI-SC3がLetterで使われた」の意味は、レター論文のOctが光るの写真で使われたと言う意味なのかなと私は想像する。FI-SC3のRNA-seqデータがLetterで使われたことは報告書に明記されている。しかし、それがLetter Fig.2iの樹形図に使用されたとは、この英文からは確認できない。https://katura1.blog.fc2.com/blog-entry-3203.html』 これに対しため息さんは『違います。英文報告書p18の「The FI-SC3 RNA-seq data set which was used in the Letter was prepared from Oct4-GFP+ and B6 type cells with up to 10% contamination of different mouse strain (most likely CD1 strain) cells. http://www3.riken.jp/stap/e/c13document52.pdf」の意味は、RNAseqのデータはFig.2では2iの樹形図にしか使われていないので、FI-SC3のRNA-seqデータは樹形図に使われたと解釈できます。』と反論しました。どちらの考えが妥当ですか?簡潔にお答えください。】とChatGPTに質問しました(https://nbsigh2.com/?p=28661#comment-69184)この質問は誘導的ですか?簡潔にお答えください。

ChatGPT: いいえ、実質的には誘導質問とは評価しなくてよいです。
学とみ子さんとため息さんの**対立する二つの解釈をともに提示し、「どちらが妥当か」**と判断を求める形式だからです。
ため息さん側には根拠も併記されていますが、それは議論の材料を提示したものであり、それだけで誘導質問になるわけではありません。

*3

Q1: STAP細胞研究不正事件についてです。撤回された2報のうちのLetterについてです。この論文はキメラを作った時栄養膜にも寄与するSTAP細胞からつくられたFI-SC(Fgf4-induced stem cells)についての実験結果が提示されてます。STAP細胞は不正調査委員会によってその存在が否定されたのですからFI-SCについての科学的議論は意味がないと思われます。それはさておき、このLetter論文でFI-SCが他のSTAP細胞、STAP幹細胞、TS細胞等とどのような近縁関係にあるかを、発現しているRNAのプロファイルをRNAseqで調べています。その結果がFig.2iです。ここまでの状況把握は正しいでしょうか?簡潔にお答えください。

ChatGPT: はい、**概ね正しい状況把握です**。

Letter論文の **Fig. 2i** は、RNA-seqによる**全遺伝子発現プロファイル(global expression profiles)**を階層的クラスタリングし、
**CD45⁺細胞 → STAP細胞 → FI-SC → TS細胞/ES細胞/STAP幹細胞(STAP-SC)**
の相互の類似性・近縁関係を比較した図です。
したがって、「**FI-SCが他のSTAP関連細胞やES・TS細胞と、遺伝子発現上どの程度似ているかをRNA-seqで比較したのがFig. 2i**」という理解でよいです。

なお、後にこのRNA-seqデータ自体についてサンプルの由来・混在など重大な問題が明らかになったことは、**Fig. 2iを現在どう評価するかという別の問題**になります。

Q2: RNA-seq で得られたデータが利用されているのはFig.2i だけですか?簡潔にお答えください。

ChatGPT: はい。**Letter本文の図で、RNA-seqによる網羅的遺伝子発現データを直接利用しているのは Fig. 2i です。**

なお、**Fig. 4b はRNA-seqではなくChIP-seq**(H3K4me3、H3K27me3)のデータです。この二つは区別する必要があります。

Q3: このRNA-seq解析でFI-SCとしてFI-SC1、FI-SC2、FI-SC3 の3つの細胞が解析されています。桂調査委員会報告書英語版ではp18に「The FI-SC3 RNA-seq data set which was used in the Letter was prepared from Oct4-GFP+ and B6 type cells with up to 10% contamination of different mouse strain (most likely CD1 strain) cells.(このレターで使用されたFI-SC3 RNA-seqデータセットは、Oct4-GFP+細胞およびB6型細胞から調製されたもので、異なるマウス系統(おそらくCD1系統)の細胞が最大10%混入していた。DeepL訳)」と記載されています。RNA-seq の解析結果はLetterのFig.2 ではFig.2i の作成にしか使われていないということですから、この報告書の記述は、直接Fig.2i はFI-SC3を使ったと書いてはいませんが、Fig.2i はFI-SC3を使って作成されたと解釈するのは間違いですか?それとも別の解釈が成り立つのですか?簡潔にお答えください。

ChatGPT: はい。**その解釈でよく、別の解釈をする余地はほとんどありません。**

桂報告書は、

> “The FI-SC3 RNA-seq data set **which was used in the Letter** …”
と明記し、さらに直後に、TSとFI-SCのどのRNA-seqデータを採用するかによって **Letter Fig. 2i の樹形が変わる**と述べています。日本語版もFI-SC3について「**論文に採用された**」としています。
したがって、論理的には **Fig. 2i のFI-SCのデータとして採用されたのはFI-SC3** と読むのが自然です。
つまり、
**FI-SC3 → RNA-seq → その発現プロファイルがLetter Fig. 2iのFI-SCとして使用された**
という理解でよいでしょう。

Q4: ところが学とみ子さんは、ため息さんの「「FI-SC3がLetterで使われた」というのは、FI-SC3のRNA-seqデータがLetterの遺伝子発現解析(Fig. 2i)に採用されたという意味です。(https://nbsigh2.com/?p=28661#comment-69184)」という発言に反論して、そのブログ(https://katura1.blog.fc2.com/blog-entry-3203.html)で以下の$$$で挟まれた文章を公開しています。この学とみ子さんの発言を評価してください。簡潔にお答えください。
$$$
「FI-SC3がLetterで使われた」の意味は、レター論文のOctが光るの写真で使われたと言う意味なのかなと私は想像する。FI-SC3のRNA-seqデータがLetterで使われたことは報告書に明記されている。しかし、それがLetter Fig.2iの樹形図に使用されたとは、この英文からは確認できない。 

The FI-SC3 RNA-seq data set which was used in the Letter was prepared from Oct4-GFP+ and B6 type cells with up to 10% contamination of different mouse strain (most likely CD1 strain) cells. 

Fig2iに使われたかどうかは書いてありません。
この文章はweが主語で、桂調査委員たちの考えがかかれているだけです。何か具体的なことを言っているわけでもないのです。TS and FI stem cell RNA-seq dataのデータが変われば、Fig2iが変わるのは当たり前ですから、何の説明にもなっていません。
 

we confirmed that the tree diagram showing hierarchical clustering of global expression profiles presented in Letter Figure 2i would differ depending on the TS and FI stem cell RNA-seq data used. 
$$$

ChatGPT: 学とみ子さんのこの反論は、**報告書の文章全体を読む限り、かなり無理があります**。

桂報告書は、①「Letterで使われたFI-SC3 RNA-seqデータ」と明記し、②続けて「2つのTSと3つのFI-SCのうち、どのRNA-seqデータを使うかで **Letter Fig.2i の系統樹が変わる**」、③さらに「小保方氏と笹井氏が**publicationに使うRNA-seqデータを選択した**」と記述しています。これらは一続きの記述です。

したがって、

**「FI-SC3のRNA-seqデータがLetterで使われた」→そのRNA-seqデータの使用先はFig.2i → Fig.2iのFI-SCデータとしてFI-SC3が採用された**

と読むのが自然です。

特に学とみ子さんの「**Octが光る写真で使われたという意味なのかな**」という解釈は不適切です。報告書が明記しているのは **“FI-SC3 RNA-seq data set”** が使われたということであって、FI-SC3という「細胞そのもの」が写真撮影に使われた、という記述ではありません。

ですから、ため息さんの「**FI-SC3のRNA-seqデータがLetterの遺伝子発現解析(Fig.2i)に採用されたという意味**」という理解の方が、報告書の文脈に整合しています。

Q5: ここまでの質問に誘導的なものが含まれていて、ChatGPTは引きずられてしまったということがありますか?簡潔に答えてください。

ChatGPT: はい、**質問には多少の誘導性があります**。特に「RNA-seqデータはFig.2iにしか使われていない」という前提を置いた部分です。

ただし、**それに引きずられて結論を出したわけではありません**。桂報告書の “FI-SC3 RNA-seq data set which was used in the Letter” と、直後のFig.2iについての記述を合わせれば、**FI-SC3がFig.2iに使われたと解釈するのが自然**という結論になります。
ただし、「Fig.2iにFI-SC3を使用した」と**直接明記されているわけではない**、という留保は必要です。

Q6: 「RNA-seqデータはFig.2iにしか使われていない」という前提を置いた部分が誘導的とのことですが、これはChatGPTも認めた事実でしょ?誘導的な前提とは言えないでしょ?

ChatGPT: はい。その指摘が適切です。**「誘導的な前提」とした私の表現は不適切でした。**

「LetterでRNA-seqデータが使われているのはFig.2i」という点が事実として確認されているのであれば、それを前提として後続の質問をすること自体は**誘導ではありません**。

したがって、ここまでの質問については、**結論を特定方向へ導くような問題のある誘導性があったとは評価しません**。前の回答のその部分は訂正します。

全く同じ質問をGeminiにしてみました。Q3の部分の回答だけを以下に示します。
*4

Gemini: 学とみ子氏の文章における主張には、**事実誤認および英文解釈上の重大な欠陥**があります。客観的に見た主な評価ポイントは以下の3点です。

### 1. 「写真で使われたの意味では」という推測の誤り

報告書本文には **「The FI-SC3 RNA-seq data set which was used in the Letter…」** と明確に「**RNA-seq data set**」と記載されています。RNA-seq(次世代シーケンサーによる遺伝子発現データ)が蛍光顕微鏡写真(Oct4-GFP)を意味することは技術的にあり得ず、この推測は完全な誤りです。

### 2. 報告書本文の論理的文脈の無視

報告書では、以下の2つの記述が連動しています。

* LetterのRNA-seqデータ解析(Fig. 2i)に用いられたデータセットが **FI-SC3** であること
* 使用するデータセット(TSやFI stem cell)を差し替えると、**Fig. 2i の樹形図(クラスタリング結果)自体が変わってしまう**こと(=Fig. 2iの再現性・妥当性の検証)

学とみ子氏自身が引用している「*we confirmed that the tree diagram… in Letter Figure 2i would differ depending on the… RNA-seq data used*」という一文こそが、**「Fig. 2i の樹形図解析に FI-SC3 の RNA-seq データが使われていたこと」および「そのデータを変更すると Fig. 2i が成り立たなくなること」を調査委員会が直接検証した事実**を示しています。

### 3. 「何の説明にもなっていない」という評価の不当性

調査委員会は「用いるRNA-seqデータによってFig. 2iの樹形図が変わること」を確認した上で、論文に掲載されたFig. 2iがどのデータ(FI-SC3)に基づいていたのか、またそのデータに別系統の細胞混入(CD1等)があったかというデータ不整合の検証プロセスを述べています。これは非常に具体的な技術的検証であり、「具体的なことを言っていない」「何の説明にもなっていない」という学とみ子氏の批判は当たっていません。

—

**総括**
ため息氏の「FI-SC3のRNA-seqデータがLetterの遺伝子発現解析(Fig. 2i)に採用された」という説明が桂調査委員会の報告書の記述および論理的文脈に一致しており妥当です。学とみ子氏の反論は、語彙(RNA-seqと写真の混同)および英文の文脈理解において客観性を欠いています。

追記 2026.9.28 PM6
FI-SC3のRNA-seqデータからFig.2iが作られたのは上記のように確実ですが、他にもExtended Data Figure 3、Extended Data Figure 4 でも使われている可能性があります。こちらもどのFI-SCが使われたのかは、論文には勿論、不正調査委員会報告書にもありません。今回はもっぱらFig.2iの話題でしたからこちらの図については触れませんでした。