ラベル AI の投稿を表示しています。 すべての投稿を表示
ラベル AI の投稿を表示しています。 すべての投稿を表示

2018年10月19日金曜日

fast.aiのJupyter NotebookがGoogle Colabで動作しなくなった【対処法】

【現状の結論】fast.aiをインストール箇所を以下に変更

!pip3 install fastai==0.7.0 torchtext==0.2.3 pillow==4.1.1

諸事情あって中断していたディープラーニングの勉強を再開しようと、fast.aiのLesson1を復習しようと試みた。で、講義で使用するJupyter NotebookをGoogle Colab上で実行してみると、見たことがないエラー。

ImportError: cannot import name 'as_tensor'

どうやらfast.aiのライブラリのバージョンが1.0になったことの影響のようだ。公式フォーラムを見ると、fast.aiをpipでインストールするところでバージョンを指定してやればよいとのことで、

fastai==0.7.0

として再度実行。が、今度は

AttributeError: module ‘torch’ has no attribute ‘float32’

とな。再度公式フォーラムを見ると同様の現象が発生している模様。数日間塩漬けにして確認してみると対応方法が掲載されていた。

!pip3 install fastai==0.7.0 torchtext==0.2.3

torchtextのバージョンも指定してやる必要があるようだ。

ちなみに、私が以前使っていた時はOut of memoryが頻発して受講には使いにくかったのだが、現状で4回ほど3行コードを実行したが、一度もメモリ不足には陥っていない(GPU指定)。

<<以下追記>>
2018/10/22
Lesson1についてセルを全て実行すると、25*50の格子状に猫の写真を表示するところで、

AttributeError: module ‘PIL.Image’ has no attribute ‘register_extensions

またかよ。。。 ということで、

!pip3 install pillow==4.1.1

※参考
https://forums.fast.ai/t/google-colab-attributeerror-module-torch-has-no-attribute-float32/25327
https://forums.fast.ai/t/fastai-v0-7-install-issues-thread/24652
https://forums.fast.ai/t/attributeerror-module-pil-image-has-no-attribute-register-extensions/10689

2018年10月11日木曜日

fast.aiのDeep Learning 2018に英日同時表示の字幕を付けてみた

※2018/10/22 追記
現在Youtubeで講義の動画を見ると、

  • Lesson1は日本語の字幕があるので、そちらのほうが良い
  • Lesson2以降は外国語の字幕がついているので、それを自動翻訳すれば同等以上(現状はロシア語=>日本語がベター)

のようである。ここで作成した翻訳より上記のほうを利用したほうが良さげである。悪しからず。

fast.aiのDeep Learingは講義を見た方々の評判がすこぶる良いのだが、この字幕を作成した5月頃にはまだ日本語の情報が少なく、活用している人は比較的少数だったのではないだろうか?現状は日本語の情報も少し増えてきていたり、講義ノートをmediumなどに公開している人も増え、以前よりはハードルが下がっているようだが、それでも英語が苦手な人には手を出しにくいだろう。

評判が良いにも関わらず情報が少ないのはGPU環境を用意しなければならないことも一因であろうが、日本語字幕がないことも大きいと思う。以前私も受講したCourseraのMachine Learningの日本語情報が豊富にある理由が日本語字幕の存在にあることは容易に想像がつく。かくいう私もCourseraのMashine Learningは字幕に頼って受講していた。まあ、実際に抜けている字幕を作成してみたところ、字幕がないパートもそこそこ理解できていたのではあるが。。。

しかしながらfast.aiは文字通りFastで実装を学習するならば最良だろうと思い字幕を作成することを考えたが、Courseraの翻訳にかかった時間を考えるととてもやってられない。そこでYouTubeが出力する音声認識された英文をGoogle翻訳で日本語に訳し、それを同時表示させてみてはどうだろう?と考えた。

日英同時字幕

画像はVLC Media Player(Windows)のもの。翻訳の質はご想像の通り完全には程遠く、肝心なところがサッパリだったりもする。でも及第点のところもあり、英語がサッパリな人には「ないよりマシ」ではあろうかと。かくいう私はLesson1はコードの実行も含め受講済み、Lesson4までを「流し見」したが、やはりこの字幕がないよりはあったほうが視聴しやすい。心理的負担が軽減されているのかな?
字幕が邪魔になるケースが少なからずあるので、字幕が扱いやすい(表示非表示が簡単に切り替えられるなど)メディアプレイヤーがあれば、それで視聴することをオススメ

というわけで、英語のみのコンテンツということで躊躇している方、一度お試しあれ。

fast.ai Deep Learining 2018 字幕ファイル
https://www.dropbox.com/s/yhnwcvxnyrs54uf/fastai_DeepLearning_Part1_vtt.7z?dl=0

2018年4月30日月曜日

AzureのCustom Vision Serviceを試したら想像以上だった

2月にJapan IT Week 関西へ赴き、主にAI関連のセミナーを受講してきたのだが、Microsoftの「AIの民主化」において、AzureのCustom Vision Serviceのデモンストレーションがそこそこの衝撃だった。セミナーではWebから適当に拾ってきたアリの画像と、とある特徴のあるアリ、それぞれ50、30枚の画像を用意し、ブラウザで登録して簡単な設定をした上で訓練開始。あっという間に必要十分と思える精度で特徴のあるアリを判別してみせた。設定は対象の写真の特徴をチェックボックスで選択するだけ。
そこそこの精度とはいえ、汎用の簡単な設定と100枚に満たない画僧だけで判別できてしまうとは。。。少なくとも百枚単位の画像データを用意し、設定値を試行錯誤するものだと勝手に思い込んでいた私には驚くべき結果だった。なので、さっそく帰るなり、手元の画像を使って試してみることに。
試してみたのは、私の住む地域で古くから伝わるジャガイモの種の識別。もともとディープラーニングの勉強の題材に使おうと種の写真をストックしておいたものがあったので、それとWeb上にあるジャガイモの画像を拝借して使用。Custom Vision Serviceの使い方などは他に譲り、試用した様子をば。


これが訓練イメージを登録したところ。左上の「honjaga」が地域の種、「potate」がWebから拝借した画像で、それぞれ58、25枚である。設定は何を選択していいのかわからなかったので汎用的に使えそうなデフォルト値(Generalだったか?)を選ぶ。じゃがいもなんて見た目にはこれといった特徴がないので、どの程度の結果が出るのか半信半疑で実行する。


適合率、再現率とも高い値。
早速、学習したモデルを使って判定を実施。まずは地元のじゃがいも。


どれも「potate」が0%。明確に判定できている。
続いて拝借したさまざまなじゃがいもの判定。


「potate」である確率が低いものがあるものの、「honjaga」の確率は全て0%。これも明確に判定できている、と言っていいだろう。
おまけ。撮影ミスで、被写体を置く手を撮影してしまったもの。指の間から辛うじてジャガイモが見えているところ。


なんと、これも「potate」の確率は0%。まあ、じゃがいも以外の特徴(背景色とか)から判別してるのだろうと思うが。。。
今回のお試しでは、地元のじゃがいもの画像が全体的に暗く土が残っているのに対し、拝借した画像の多くはきれいに洗浄されたじゃがいもで明るい画像が多かった。アルゴリズムが画像のどの特徴を捉えて判定しているかはブラックボックスだし、この結果を持って種の判定が容易に可能になったとは判断できない。しかし、当初想像していたよりもはるかに低コストで判定は可能であろう、という手ごたえが掴めたことは大きなモチベーションとなった。
ディープラーニングが「知らない人だけが損をする」時代になるのも目の前である。

2018年4月25日水曜日

「きゅうりの仕分け」記事への違和感

元組み込みエンジニアの農家が挑む「きゅうり選別AI」 試作機3台、2年間の軌跡
http://www.itmedia.co.jp/enterprise/articles/1803/12/news035.html

2年ほど前に話題となった「きゅうりの仕分け」。一日4千本のきゅうりを仕分ける作業の省力化に、と取り組まれたもので、これを機にディープラーニングに注目した地方の人もいるのではないだろうか。AIがビッグビジネスだけでなく、私たちの日常生活に入り込んくるものであることを知るきっかけともなる、とても興味深い取り組みだ。今回、ITMediaにその軌跡を辿る記事が紹介されたので読んでみた。

個人的に印象的だったのは、コンベヤによる自動仕分けによって収穫物を傷つける、というところだ。AIとは直接関連しないところだが、AIがどんなに素晴らしい判定をしたとしても、人力に代わる部分の省力化が難しいということだ。実は、自分の地域でAIを活用するアイデアや、地元の業者さんに使ってもらえそうな企画もいくつかあるのだが、実現が難しいのはハードウェアの作り込みだ。過酷な自然環境に耐えるようなハードが趣味の電子工作と日曜大工レベルの人間に簡単に作れるようになるとは到底思えない。そういったノウハウを持った業者さんに発注すれば、大きなコストがかかることは想像に難くない。紹介記事はそのことを具体的に示唆するものであり、大いに参考になった。

で、肝心の「違和感」である。記事の中では精度について述べられているのだが、印象として「精度が良くない」という内容になっていると受け取った。で、実際の数字云々はともかくとして、何に違和感があるのか?それは精度について、人間が仕分けた場合との比較が示されていないことだ。人間がどの程度の精度で仕分けができているのかがわからないと、AIの仕分け精度の良し悪しは判定できないはずだ。理想的な判定は、まずパーフェクトに仕分けられた画像が存在し、それを機械学習にかけて判定を行うことだ。そして、それが人間が仕分けた場合の精度とどちらが高いのか、これが精度の良し悪しの判定となるはずだ。しかし、記事の中では、人間の仕分け精度については全く触れられていない。そこで、「中の人」のブログがあったので、これに関する記事を探してみる。すると、「今回の場合は、各分類クラス間が離れていないため、人間がやっても“2LとL”や“LとBL”の判別は難しい(けっこう適当)だったりします。」という記述を発見。うーん、これはやはり仕分けの「正解」に問題があるのではなかろうか?

もし厳格なルールがなく、人間が一度仕分けしたものを「正解」としているのであれば、それはその「正解」の精度を疑うべきである。どんなに優れた熟練者であろうとも人間であればバイアスから逃れることは困難だし、間違いも起こす。しかも、「けっこう適当」と言っているのであればなおさらだ。やっている本人は百も承知でやっていることと思うが、記者はきっとこういったことが分からないで書いているのだろう。前回書いた記事は、実は今回の記事の伏線だったりするのだが、AIは人間のバイアスをそのまま取り込むのである。これは非常に難しい課題なのだろう。

では、このようなケースではどうやって訓練画像をカテゴライズすべきなのだろうか?そういった研究もされているのだろうか?人間が経験と勘で仕分けたものを正解とするより、AIに学習させたものを正解にするほうが最終的な精度は高くなるのではないか?などと思ったりもするのだが、実際はどなのか。そんなこともディープラーニングを勉強する中で実験できれたら、などと思うのである、今だけは。

2018年4月1日日曜日

「人工知能もバイアスを必然的に取り込んでしまう」

「人工知能もバイアスを必然的に取り込んでしまう」
http://trendy.nikkeibp.co.jp/atcl/pickup/15/1003590/031701613/
SXSW(サウス・バイ・サウスウエスト)という世界有数のカンファレンスにレイ・カールワルツが登壇したとのことで記事になっている。そのカールワルツが言うわけである、「人工知能もバイアスを必然的に取り込んでしまう」と。
まあ、そりゃそうだとは思うわけだが、AIを駆使していこうとすれば、このことは気を付けなければならないことだ。せっかく計算機に仕事をさせるのだから人間のバイアスなどない答えを期待することが中心になるはずだ。機械学習において学習させるデータにバイアスが混入すれば当然学習済みデータにもバイアスが混入するわけだ。人間の仕事が介入する以上、バイアスを根絶することは不可能だろうが、できるだけバイアスを排除するよう配慮することは常に課題として
世の中の事例を見ていると、これはバイアスが混入していているのでは?と思しきものもある。そういったところを考察してみるもの一興かもしれない。

2018年2月26日月曜日

Cousera Machine Learningの日本語字幕の不足分

機械学習入門の定番と言って過言ではないだろう、スタンフォード大学発のMook、CourseraのMachine Learning。非常に丁寧な解説であるとともに、日本語字幕もあるということで、日本のWeb上ではかなりの評判。最近ではDeep Learningを中心とする、日本語の機械学習コンテンツも増えてきているが、認定書が不要であれば無料で受講できることもあってか未だに人気のようだ。かくいう私も受講し、非常に有意義なものだという印象を受けている。

しかし、字幕がズレて利用困難になっていたり、字幕が飛んでしまっている講義があって難儀することも確か。特にWeek6は3本の講義が字幕を使えない状態で、私も難儀した。で、最近復習がてら講義ビデオを見直したので、その時に足りない字幕を作成してみた。作業自体はかなり機械的だったにもかかわらず、かなり苦労した。せっかくなので公開して、必要な方に利用してもらおうか、と。

作製した字幕は以下の通り。

  • Week1
    • Gradient Descent For Linear Regression
  • Week2
    • Gradient Descent in Practice II Learning Rate
  • Week3
    • Classification
    • Simplified Cost Function and Gradient Descent
  • Week6
    • Model Selection and Train/Validation/Test Sets
    • Diagnosing Bias vs. Variance
    • Regularization and Bias/Variance

字幕のズレを修正し、不足分は英文字幕のGoogle翻訳で補いつつ文言を合わせ、どうしても理解できない箇所だけ意訳をした。正直なところ意訳したところはイマイチだし、文言合わせもいいかげんだ。それをご了承の上、利用していただきたい。元にした字幕のライセンスについては調べていないので、問題があるようなら指摘して欲しい。

※字幕ダウンロード(7zipファイル)
https://www.dropbox.com/s/em1f7mst16zsomq/Coursera_Machine_Learning_vtt.7z?dl=0

※2018/3/19 追記
Week3の2つのファイルが入っておらず、別のファイルを入れてしまっていた。差し替え済み。

2018年2月23日金曜日

マーケターがセンスでマーケティングをする時代は終った

結論:データを集めろ!!今すぐに。

まあ、冷静に考えれば当然のことですわ、当然、ね。

Japan IT Week関西 2018とメディカルジャパン(同時開催)に参加した。目的はAI関連の業界動向と雰囲気を感じ取るため。AI界隈の展示はここ2年くらいはカオスの様相を呈していて「これの何がAIサービスで、何の価値を提供してるの?」と問いただしてみたくなるようなものもあった。きっとまだ混沌としたものだろうなあ、などと想像していたが、もう落ち着いたようだ。AI利用を強調したサービスはコールセンターなどのBotか「こんなことできますよ」とテクノロジーを見せるものに集約した。あとは業務自動化がAIと同じくくりになっていたためか、RPAが目立った。RPAは海外性の特定のも製品を複数の会社がサービスとして提供しているようだが。
また、今回は展示会よりもAIに関する講演を聞く時間を多くとり、約40分の内容を9本受講した。印象的だったのは~外資が面白く国内がつならない学者が面白く企業がつまらない`ということ。学者の話しなんて小難しくて退屈な印象だろうが、全く逆で、国内大手企業の講演で「あぁ、日本の大企業だなぁ」なんて思いながらウトウトしたのだった。。。

それはさておき、AIの話しはどれも刺激的だった。医療系は、次世代シーケンサーの登場によりゲノムデータが膨大化し、これに今のAIを適用しない手はないだろう、と。無論、課題も山積みのようであるが、ここから数十年かけてかなりの発展が期待できる、という印象を受けた。また、IT関連も衝撃的だった。セールスフォースを見たら、ECを構築したり営業を強化したかったらセールスフォースを使っておけば問題なし、と思わさせられたし、マイクロソフトがAzureで今時のAIをいろいろと無料でお試しさせてくれていることも理解していなかった。本当に時代は急変していて、自分が全くついていけてないことに戦慄をおぼえた。

そんなことを考えていたら、こんな当然のことに全く気付いていなかった自分がさらに恐ろしくなった。今のビッグデータとAIブームの下では、もう勝者は決まっているのである、そう、ビッグデータを持っているところが勝ち、他が負けたのだ。じゃあ、負けた連中はどうするのか?答えは簡単。勝ったもののビッグデータとAIの乗っかるのだ。ECを構築したければセールスフォースのような現状の勝ち組のECサービスを使えばいいし、多様な分析をしたければ、やってくれるサービスを使えばいい。いや、他に手はないだろう。

というわけで、最初に書いた結論である。あいにく現状はビッグデータ&AIの利活用の成果が明確になりだしたばかり。今からデータ取りを始めておけば、他より先行してその利益を得られるかもしれない。いずれ皆が同じようにデータを収集して最適なソリューションを得らるようになるのだから、やるのが早いかどうかの違いだけである。やったところで時は既に遅し、かもしれないが、どうせやるなら早いほうがいいでしょ?特に、地域で小さなビジネスを営む人たちは、まだライバルがAIに手を出していないケースも多いだろうから、直にでもデータ収集を始めることをお勧めする。何をどうとればいいかわからないだろうが、取れるものをできるだけ多くとっておけばいい。映像、画像、音声、温度湿度、明るさ、すぐに出来るものが幾らでもあるのだから。

2017年11月19日日曜日

AIの進化についていけない大多数の人たち

以下の記事が目に入る。

「AIで弁理士が失業」に異議 「そんなに単純な仕事じゃない」 日本弁理士会の梶副会長(Yahoo!ニュース)
https://headlines.yahoo.co.jp/hl?a=20171116-00000074-zdn_n-sci&utm_content=buffera06a0&utm_medium=social&utm_source=twitter.com&utm_campaign=buffer

弁理士の仕事の92%はAIによって代替可能、という研究機関らの発表に日本弁理士会の会長がご立腹なようで。それはさておき、この中で「簡単にAIに代替できない」こととして、以下のもの挙げられている。

  1. 知的財産とは「人間の生活を豊かにするもの」→AIに「人間とは何か」が分かるのか
  2. 依頼人との空気感が重要→依頼人の放つ「空気」が読めるのか
  3. 依頼人の意図を把握する必要がある→依頼人自身も気付いていない場合もある
  4. 最適解は常に変化する→出願断念、応答断念が最適解の場合もある
  5. 発明者を見抜く力がいる→発明者は往々にしてうそをつく

これを見たときの第一感が「AIの進化についていけてない」であった。改めて読み返せばそれ以前の問題のほうが多いが、1項目づつ簡単な所感をば。

1. 知的財産とは「人間の生活を豊かにするもの」→AIに「人間とは何か」が分かるのか

この方、「人間とは何か」が分かるのか。。。ぜひ教示して欲しいものだ。まあ、はっきり言って何が言いたいのかよくわからない。あいまいな事象ならAIにはわからないだろ、という印象を持っているのだろう。

2. 依頼人との空気感が重要→依頼人の放つ「空気」が読めるのか

これもまた「空気感」という謎のワード。その昔はやった「KY」のことを言いたいのだろうか。これも1と同じだが、そんなもの人間だってよくわらない。また、何をもってAIにはできない、と判断してるのだろうか?人間が「空気を読む」場合の判断材料は恐らく「視覚」「聴覚」「言語」だろうから、AIに代替可能なものではないだろうか?もっとも人間がこの人の言う「空気を読む」ことを定義できるとは思えないが。

3. 依頼人の意図を把握する必要がある→依頼人自身も気付いていない場合もある

この方が自分自身で何を言ってるのか分かってないことと同じように(笑)、依頼人も自身が気づいてないことがあるようだ。しかし、そういうことこそAIが得意とするところじゃないの?実際に、Webサイトの閲覧者が欲しそうな情報を先回りして提示するようなことが既に実用化されているし。

おもてなしで老舗旅館がAI(人工知能)を導入、自社サイト予約が2ケタ増も、 箱根で始まった経営者の挑戦を取材した(トラベルボイス)
https://www.travelvoice.jp/20171020-97287

4.最適解は常に変化する→出願断念、応答断念が最適解の場合もある

これも意味不明。AIと何の関係があるのか?なぜAIにできないと考えたのか?
何が言いたいのかわからない。

5.発明者を見抜く力がいる→発明者は往々にしてうそをつく

現在のAIによるウソ発見器は目覚ましく進歩している、といった記事は枚挙にいとまがない。面倒なので、知りたい人はぐぐるなり何なりと。

改めて5項目を見てみたが、そもそもこの方はAIで何ができるか知らないようだし、どういったことが出来そうか、という考察も全くないと思われる。立場が立場だけに話せないこともあるだろうし、記事が発言を婉曲している可能性も否めないけど、反論するならもう少し理論武装しろよ、と。弁理士会の会長がこんな体たらくで本当に大丈夫なのか?と不安になる。

いずれにしても、世の中の大多数の人は恐らくAIの進化についていてないのだろう。私自身、とてもついていけてるとは思えない。誰にだってバイアスはあるし、劇的な変化を許容できないこともある程度仕方ないことだが、こういう謎の反論にはむなしさを覚えずにはいられない。自分の職がAIによって9割奪われる、という指摘があったらこんな風に考えられないのだろうか?

「それなら残った困難な1割に集中できる。素晴らしい!」

最近の投稿

セミリタイヤ

九州へ一人旅をしてきた。 過去にも自分で節目を感じるようなときに一人で遠出し、自分自身を振り返る機会を作ったことがある。今回もそういった意味もあり、過去に行きながらも時間が足りなかった熊本(阿蘇)と長崎へ。 阿蘇の風景 カルデラそのものの阿蘇の景観は他では見るこ...

人気の投稿