[スポンサーリンク]

化学者のつぶやき

IASO R7の試薬データベースを構造式検索できるようにしてみた

[スポンサーリンク]

今回はSignals Notebookを使ってIASOの試薬データベースを構造検索できるようにしてみたので、その方法をご紹介します。
(IASO以外のデータベースを使っていても、そのデータベースから化合物のcas番号のリストをダウンロードできれば同じことができます!)

試薬を取り扱う研究室であれば、「試薬管理システム」を使っていると思いますが、皆さんはどの試薬管理システムを使っているでしょうか?

試薬管理システム – 企業6社の製品一覧とランキング

アカデミアでは、比較的コストが安い「IASO」を大学で契約しているという所も少なくないのではないでしょうか。しかし残念なことにIASOには構造式情報がなく、自分の研究室のInventoryにどのような試薬やビルディングブロックがあるかということが把握しづらいです。棚ごとに試薬を分類してある程度類似のビルディングブロックをまとめて保管することはできますが、複数の特徴を持つ化合物はどの棚に入れるか?という問題が出てくるため、結局完璧な管理方法にはなりません。

上記リンクの最近使われている試薬管理システムは構造検索もできて便利なものがありますが、とあるシステムに問い合わせると1ラボ単位で年間〇〇◯万円!?(値段は伏せますが)、とても大学や研究室単位で契約できる値段ではありませんでした。

そこで、IASOに登録されている化合物のデータを効率よく構造情報化して、「Signals Notebook(Standard Edition)」を使って検索できるようにしてみたので、その過程をご紹介しようと思います!

 

1.     IASOから登録試薬のリストを.csvで書き出す

1-1. IASO R7にログインし、Data Manager → 在庫リスト → 検索対象は特に選択せず全てのままLISTを選択

1-2. 在庫リストの全てのチェックボックスにチェックを入れてダウンロード

試薬情報がまとまったcsvファイルが手に入る。

2.     ChemCell(フリーソフト)でCAS番号をSMILESに変換

2-1. ChemCell(GitHub)のCode → Zip DownloadでChemCell(マクロ入り.xls)を入手します。

2-2. ChemCellを開きマクロを有効に。

2-3. 先程IASOからダウンロードした.csvファイルをexcelで開き、CAS No.と容量の列をコピーしてChemCellの適当なシートのB,C列にペーストする。「内容量」は「Amount」などに書き換えておく。

2-4. A1 cellに「Structure」、A2 cellに=getSMILES(B2)と入力(B2 = CAS番号のcell)

2-5. A列のD2からデータがあるセルまで全てを選択

(C1にカーソルを持っていき、[Ctrl+↓]で一番下に飛ぶので、Aの一番下のcellにカーソルをあわせて[Ctrl+Shift+↑]で一挙に選択できる)

2-6. [Ctrl+D]で全てのCAS番号を一挙にSMILESに変換

ここでデータ数によるが、2600件程度だと大体25~30分程度かかりました。CPUのマルチコア性能に依存します。

2-7. ここで一旦名前を付けてマクロ有効ブックで保存。マクロを無効にした通常の.xlsxファイルでも保存しておくとよい(後述)。

3.     ChemDraw for ExcelでSMILESを構造式に変換

3-1. シートをChem Office worksheetに変換する。

3-2. 生成したSMILESを全選択し、ConvertからConvert SMILES to Structure

(ここは結構さっくり、2,3分で終わりました。もともとSMILESに変換しそびれていた83個のセルは正常に変換できませんでしたと言われました。CAS to SMILESの問題です。)

3-3. 構造式に変換できなかったCellのみデータを消去したい。A2 cellにカーソルをあわせて[Ctrl+Shift+↓]でA2以下のcellを全選択し、右クリック → 値と数式のクリアによって構造情報のみを残す

4.     SDファイル(.sdf)で書き出してSignals NotebookのMaterialsに一括登録

4-1. SDファイルで書き出す際に、A2 cellに構造が入っていないとエラーになり書き出せないので、はじめに構造が出てくるcellまで空行を消去する。

4-2. Inport/Export → Export Table → 名前を付けて.sdfで保存

4-3Signals NotebookMaterials.sdfを読み込む。Materials内のReagents (SNB)()を選択して、右上のAdd NewからBulk Import Compounds.sdfファイルを読み込みます。

Materialsは初期設定ではONになっていないので、System Configurationで設定する必要がある。長くなるのでこちらは次回!

5.     実際に検索してみると・・・

例えば、名前検索で「ベンジルアルコール構造」を部分構造にもつ化合物を検索しようと思ってもなかなか難しいはず。ベンジルアルコールの構造を描きSubstructure Searchをし、検索範囲をMaterialsに絞り込むとこの通り。ベンジルアルコール構造を持つものだけがヒットしました。

ただし、今回の方法では、CAS to SMILESが100%の精度ではないため、完璧な構造データベースへの移行はできていません。構造式が入らなかった化合物は、ChemOffice Worksheetに変換する前の状態で名前を付けて保存しておいた.xlsxファイルを開けば確認可能。マクロ有効ブックやChemOffice Worksheetはデータ量が多く重いので、データ量を減らしたsheetで確認する方がよい。

現状では、IUPAC名を出してくれないIASOではCAS to Structureしか構造式に一括変換する手法は存在しないため、変換漏れしたものは手作業で入力するしかない。

なにか良い方法を知っている人がいればご連絡いただければ非常に助かります!

6.     継続的なデータベースの更新方法

IASOでData Managerを開き、登録薬品リストをクリック。集計期間を指定してLISTを押すと、その期間中に登録された試薬を集計できます。
ダウンロードボタンでcsvファイルをダウンロードできます。

 

Signals Notebookの設定は次回記事で!

関連リンク

電子ノートSignals Notebookを紹介します!

Macy

投稿者の記事一覧

有機合成を専門とする教員。将来取り組む研究分野を探し求める「なんでも屋」。若いうちに色々なケミストリーに触れようと邁進中。

関連記事

  1. 印象に残った天然物合成 2
  2. 天然物の生合成に関わる様々な酵素
  3. 今こそ天然物化学☆ 天然物化学談話会2021オンライン特別企画
  4. 第98回日本化学会春季年会 付設展示会ケムステキャンペーン Pa…
  5. 合成生物学を疾病治療に応用する
  6. 日本初の化学専用オープンコミュニティ、ケムステSlack始動!
  7. 【速報】2011年ノーベル化学賞は「準結晶の発見」に!
  8. とある化学者の海外研究生活:スイス留学編

コメント、感想はこちらへ

注目情報

ピックアップ記事

  1. 化学の力で複雑なタンパク質メチル化反応を制御する
  2. タンパク質の非特異吸着を抑制する高分子微粒子の合成と応用
  3. ヘメツバーガー インドール合成 Hemetsberger Indole Synthesis
  4. ロナルド・ブレズロウ賞・受賞者一覧
  5. 少年よ、大志を抱け、名刺を作ろう!
  6. 2018年 (第34回)日本国際賞 受賞記念講演会のお知らせ
  7. ポンコツ博士の海外奮闘録⑥ 〜博士,アメ飯を食す。おうち系お肉編〜
  8. 第19回「心に残る反応・分子を見つけたい」ー京都大学 依光英樹准教授
  9. 進め、分子たち!第2回国際ナノカーレースが3月に開催
  10. 危険物に関する法令:点検・設備・保安距離

関連商品

ケムステYoutube

ケムステSlack

月別アーカイブ

2022年3月
 123456
78910111213
14151617181920
21222324252627
28293031  

注目情報

注目情報

最新記事

in-situ放射光X線小角散実験から明らかにする牛乳のナノサイエンス

第425回のスポットライトリサーチは、高エネルギー加速器研究機構 物質構造科学研究所(物構研)の高木…

アセトアミノフェン Acetaminophen

 アセトアミノフェン (acetaminophen) は、有機化合物の一つ。海外ではパラセタ…

不安定な高分子原料を従来に比べて 50 倍安定化することに成功! ~水中での化学反応・材料合成に利用可能、有機溶媒の大幅削減による脱炭素に貢献~

第424回のスポットライトリサーチは、京都工芸繊維大学大学院工芸科学研究科 バイオベースマテリアル学…

【10月開催】マイクロ波化学ウェブセミナー

<内容>今月もテーマを分けて2回開催いたします。第一…

越野 広雪 Hiroyuki Koshino

越野 広雪(こしの ひろゆき)は、NMRやマススペクトルなどのもとにした有機分子の構造解析を専門とす…

bassler ボニー・L.・バスラー Bonnie L. Bassler

ボニー・L.・バスラー (Bonnie Lynn Bassler , 1962年XX月XX日-)は、…

電子を閉じ込める箱: 全フッ素化キュバンの合成

第 423 回のスポットライトリサーチは、東京大学 工学系研究科 化学生命工学専…

プラズモンTLC:光の力でナノ粒子を自在に選別できる新原理クロマトグラフィー

第422回のスポットライトリサーチは、名古屋大学 大学院工学研究科 鳥本研究室の秋吉 一孝 (あきよ…

マテリアルズ・インフォマティクスの基礎知識とよくある誤解

開催日:2022/10/04 申込みはこちら■開催概要近年、少子高齢化、働き手の不足の影…

クオラムセンシング Quorum Sensing

クオラムセンシング (Quorum Sensing)クオラムセンシング (Quorum Sens…

Chem-Station Twitter

実験器具・用品を試してみたシリーズ

スポットライトリサーチムービー

PAGE TOP