スキップしてメイン コンテンツに移動

!おまけ

[[なんかバトンがきたので書く|http://d.hatena.ne.jp/syou6162/20081218/1229539204]]。てか、syou6162の参考にはならない気がするぞw

お勧めというよりは今年わりとマジメに読んだ本を挙げていくことにする。2008年に出版された本はほとんどない:-) ちなみにPRMLはまだ読めてない。

今年日本語訳も出た{{isbn '1584886420は必読。あれ、これしか読んでない>ω<

来年は発生科学の科学史っぽいものや、脳や行動と学習理論あたりを読んでも良いとは思っている。

今年はモデル選択が中心だったな。去年読んでいた{{isbn '4000068431のわからないところが{{isbn '4781912125と{{isbn '4254127820と{{isbn '4320021711を読んだらわかった。KL情報量からAICまでしっかりと理解が繋がったのが成果だった。細かい話になるが、これらと並行して混合正規分布のパラメータ推定まわりを理解するために、{{isbn '4000068512 も読んだ。

来年こそはベイズ、特にPRML読みたいが確率過程と統計力学が先か。まあ、必要になった統計を乱読だろうな。

読みものとしては{{isbn '4140019913が楽しめた。生命科学で考えてみてもよい問題意識がいくつかあると思った。でもこの本が扱っている内容がファイナンスの数理全体のなかでどういう位置のトピックスを扱っているかよくわからなかった。

生命科学でも頻繁に出てくるようになったランジュバン方程式と幾何ブラウン運動を理解するために、{{isbn '450161790X と {{isbn '4501619406 の一部を読んだ。とても理解しているとは言えない程度だが。この2冊はボス部屋の本棚から借りパク:-)

ということもあって、来年は、{{isbn '4431710922と{{isbn '3540208828あたりを読みたい。前者は読み始めていてマルコフ過程のころが眠くなった。Rでシミュレーションしながら読むとたいくつしのぎになるかも。[[大野先生が配布しているPDF|http://webusers.physics.uiuc.edu/~y-oono/]]も使う予定。

同期の話とかちゃんと読んだことがなかったので{{isbn '4087204081が楽しめた。臨時別冊・数理科学の「ネットワーク科学への招待」も最新の論文が広くまとめられていて良かった。

来年は統計力学を{{isbn '4563024376で勉強しなければ。確率過程と同様、[[大野先生が配布しているPDF|http://webusers.physics.uiuc.edu/~y-oono/]]も使う予定。

今年はあまりプログラミング系の本は読んでいないな。

{{isbn '4901683500 去年出版だけど、俺が読んだのは今年に入ってから。Rでプログラミングするのに持ってないとかありえないという本。目次で逆引リファレンス的に使うのが吉。

{{isbn '4873113644 スクラッチからデータマイニング関係のプログラムを書く練習にはなった、普段はRでいいけど。あとPythonの読み書き力が少し向上した。Pythonの本を読んでもよかった気がするけどWebの情報だけでなんとかなるぐらいドキュメントが豊富。しかもオライリーの初めてのPythonがありえない厚さで、おっさんの体力的には読めないと思ったので1冊も購入せず。良い本があれば教えてしてくださいな。ちょっと毛色が違うが、シミュレーションの実装なんかでは {{isbn '4274067475 が良いかもしれないと思って読んでいる。

{{isbn '4873113563 Rubyでのテスト駆動開発が豊富な例とともに解説されいる。どういう時にどういうテストを書けばよいか感覚を掴むには良い本だったと思う。

来年はTDD、デザパタ、関数プログラング系をやっつけたい気がするが、たぶん今年同様、数理のほうメインで読んでいく流れだろうな。ただ仕事上、3Dグラフィックス系を読まなねばらんかも。

スピードなんちゃら、レバレッチなんちゃら、勝間さん系を数冊読んだ。ためにはなったがGTDの時ほど生活が変わる感じではなかった。

ドラッカー買ったけど積読中。いまいちモチベーションがわかない。

はじめてラノベに取り組んだ。

{{amazon '4840233020 これが大好きすぎて全巻プラス単行本化されていない短編もほぼ収集した。たぶん10周以上は読み返している。俺も見た目かわいらしい系で知的な女の子と旅したい。ホロかわいいよホロ。

コメント

このブログの人気の投稿

シーケンスアダプタ配列除去ツールまとめ

FASTQ/A file からシーケンスアダプター配列やプライマー配列を除くためのプログラムをまとめてみる。 まず、配列の除去には大別して2つの方向性がある。ひとつは、アダプター配列を含む「リード」を除いてしまう方法。もうひとつは除きたい配列をリードからトリムする方法である。後者のほうが有効リードが増えるメリットが、綺麗に除ききれない場合は、ゲノムへのマップ率が下がる。 気をつける点としては、アダプター/プライマーの reverse complement を検索するかどうか。paired end の際には大事になる。クオリティでトリムできるものや、Paired-end を考慮するものなどもある。アダプター/プライマー配列の文字列を引数として直接入力するものと、multi fasta 形式で指定できるももある。 From Evernote: シーケンスアダプタ配列除去ツールまとめ TagDust http://genome.gsc.riken.jp/osc/english/software/src/nexalign-1.3.5.tgz http://bioinformatics.oxfordjournals.org/content/25/21/2839.full インストール: curl -O http://genome.gsc.riken.jp/osc/english/software/src/tagdust.tgztar zxvf tagdust.tgz cd tagdust/ make sudo make install rehash 使いかた: tagdust adapter.fasta input.fastq -fdr 0.05 -o output.clean.fastq -a output.artifactual.fastq 解説: 入出力形式は fastq/a が使える。リード全体を除く。速い。アダプター配列を fasta 形式で入力できるのが地味に便利で、これに対応しているものがなかなかない。Muth–Manber algorithm (Approximate multiple

ChIP-seq の Peak calling tool を集めたよ

ほかにもあったら教えてください。プログラム/プロジェクト名がツールのプロジェクトサイトへのリンク。その論文タイトルは論文へのリンクになっています。 ツール名の50音順です。 CCCT -  A signal–noise model for significance analysis of ChIP-seq with negative control , chipdiff と同じグループ CisGenome -  CisGenome: An integrated software system for analyzing ChIP-chip and ChIP-seq data . ChromSig -  ChromaSig: a probabilistic approach to finding common chromatin signatures in the human genome. ChIPDiff -  An HMM approach to genome-wide identification of differential histone modification sites from ChIP-seq data ChIP-Seq Analysis Server FindPeaks -  FindPeaks 3.1: a tool for identifying areas of enrichment from massively parallel short-read sequencing technology. Version 4.0 is out. GLITR -  Extracting transcription factor targets from ChIP-Seq data HPeak -  HPeak: an HMM-based algorithm for defining read-enriched regions in ChIP-Seq data MACS -  Model-based Analysis of ChIP-Seq (MACS). PeakSeq -  PeakSeq enables systematic scoring of ChIP-seq experimen

ふりかえり

2013年4月に独立して7年目が終わろうとしている。ざっくりこれまでの研究を振り返る。 2013年から2017年の4年はフルスタックのゲノム科学、ゲノムインフォのラボを立ち上げることに集中していた。しかも人様が作った技術のユーザとして研究するのではなく、新しい技術を開発できるラボを目指した。ウェットの開発については、ドライのPIであっても本物を創りたいと考えたので世界最強や唯一の技術を目指した。特に1細胞ゲノム科学に注力した。そのためにまずグラントを取り仲間を集め技術を作った。幸いウェットは元同僚を中心に、ドライはドクター新卒の優秀な人材に囲まれた。並行して開発した実験やデータ解析技術を応用するため、データ生産や共同研究を支えるチームも作った。 2015年ぐらいからドライの論文が少しずつ出始め、2018年にはウェットのフラッグシップとなる技術RamDA-seqとQuartz-Seq2の2つ出版された。2021年1月現在、これらはそれぞれ世界唯一と世界最高性能の2冠である。これが達成できた大きな理由のひとつは、反応原理を徹底的に理解し制御するというチームやそのメンバーの特性にある。ここは世界最高レベルだと確信している。 2017-2018年はラボの移転がありウェットの開発や実験が大きく停滞した。その間ドライのチームががんばってくれて2019-2020年にはドライ研究の収穫の時期がきた。またRamDA-seqの試薬キット化・装置化、Quartz-Seq2とそのデータ解析技術での起業、実験試薬や道具の上市など社会実装の年でもあった。実験が少なくなった分、ウェットのメンバーの解析技術がかなり向上した時期でもある。これはウェットとドライがうまくコミュニケーションできる証拠でもある。 2019-2020年はウェット技術のフラッグシップを駆使した共同研究がいくつか花咲いた。主に「再生医療分野」への応用と「細胞ゆらぎと転写制御の謎」に迫る基礎的なテーマが対象で、もともと1細胞ゲノム科学を始めたときに目標としたものだった。 並行してゲノムデータの科学計算環境のインフラ開発に注力してきた。beowulf型PCクラスタからクラウドの移行やハイブリッド化、DevOpsによる自動構築、ワークフロー言語の導入、動的レポート生成などの導入・開発を行いこれらを日常的に使うラボになった。これらはNI