-
MNIST
0から9までの手書きで書かれた数字の画像データ。28×28ピクセルのグレースケールの画像で、60000枚のトレーニング画像と10000枚のテスト用画像。 -
CIFAR-10
飛行機,車,鳥,猫,鹿,犬,蛙,馬,船,トラックの10種類のカテゴリに分類された32×32ピクセルのカラー画像データ。カテゴリごとに6000枚,合計60000枚(トレーニング用に50000枚,テスト用に10000枚)。 -
STL-10 dataset
飛行機,車,鳥,猫,鹿,犬,蛙,馬,船,トラックの10種類のカテゴリに分類された96×96ピクセルのカラー画像データ.カテゴリごとにトレーニング画像500枚,テスト画像800枚.また,100000枚のラベルのない画像データ(10種のカテゴリに属さないものも有)も含む. -
livedoor ニュースコーパス(無料)
9 カテゴリのニュース記事,CC BY-ND 日本語の雑多なニュースからCCライセンスの記事のみを取り出し、HTMLタグなどを自動的に取り除いて文章のみとしたもの。テキストの他、Apache Solr向けのデータも提供されている。Apache