ディープラーニングの人気記事 175件

1 - 40 件 / 175件

新着順人気順

絞り込み

検索対象
ブックマーク数
期間
セーフサーチ

ディープラーニングの検索結果1 - 40 件 / 175件

LLMの現在 - Speaker Deck
- 1041 users
- speakerdeck.com/pfn
- テクノロジー
- 2024/03/29
今のLLMを取り巻く状況について紹介します。
- AI
- LLM
- あとで読む
- 機械学習
- 人工知能
- ChatGPT
- 資料
- 文化
- IT
- slide
エンジニア・データ分析職の方々にお薦めしたい、LLM時代に不可欠な教養が身に付くテキスト3選 - 渋谷駅前で働くデータサイエンティストのブログ
- 590 users
- tjo.hatenablog.com
- テクノロジー
- 2023/07/02
︵﹃IT Text 自然語処理の基礎﹄より︶3ヶ月ほど前に空前のLLMブームについて概観する記事を書きましたが、それ以降も世間のLLMに対する狂騒ぶりは収まるどころかますます拍車がかかるという有様で、あまつさえ僕自身の仕事における日常業務にもじわじわと影響が及びつつあり、今後も良きにつけ悪しきにつけLLMと共生し続ける必要がありそうだと感じている今日この頃です。そんな猫も杓子もLLMに群がるが如き空前のブームを受けて、エンジニアやデータ分析職の方々の中には﹁LLMに興味はあるんだけど世の中にあまりにも多くのLLM関連コンテンツが溢れ返っていて何から手をつけたら良いのか分からない﹂という向きもあるように見受けられます。そこで、僕も断じてLLM以下生成AIの専門家などではないのですが、個人的に﹁このテキストを読めばLLM時代を生き抜くことが出来そうだ﹂と感じた書籍を、全くの独断と偏見で3冊
- LLM
- あとで読む
- 機械学習
- 学習
- エンジニア
- AI
- 自然言語処理
- データ
- 本
- 勉強
控え目に言って革命。OpenAI、動画生成AIモデル「Sora」発表
- 568 users
- ascii.jp
- テクノロジー
- 2024/02/16
OpenAIは2月15日（現地時間）、テキストから最大1分間の動画を生成できる動画生成AIモデル「Sora」を大量のデモ動画と共に発表した。複数のキャラクター、特定の種類の動き、被写体と背景の正確な詳細を含む複雑なシーンを生成することができるという。プロンプトから破綻のない動画を生成 Introducing Sora, our text-to-video model. Sora can create videos of up to 60 seconds featuring highly detailed scenes, complex camera motion, and multiple characters with vibrant emotions. https://t.co/7j2JN27M3W Prompt: “Beautiful, snowy… pic.twitter.com
- AI
- あとで読む
- 動画
- OpenAI
- 人工知能
- webサービス
- これはすごい
- プロンプト
- 技術
- 映像
Sakana AI
- 565 users
- sakana.ai
- テクノロジー
- 2024/03/21
概要 Sakana AIは進化や集合知などの自然界の原理を応用して基盤モデルを開発することを目指しています。私達の目標は、モデルを自ら訓練し開発することだけではありません。基盤モデルの開発を効率化、高度化、自動化するための新たな手法を生み出すことに挑戦しています。この目標に向けた第一歩として、私たちはプレプリント﹁Evolutionary Optimization of Model Merging Recipes ︵モデルマージの進化的最適化︶﹂を公開しました。このリリースの要点は以下の通りです。進化的モデルマージという手法を提案します。これは、多様な能力を持つ幅広いオープンソースモデルを融合︵マージ︶して新たな基盤モデルを構築するための方法を、進化的アルゴリズムを用いて発見する手法です。私たちの手法は、ユーザーが指定した能力に長けた新しい基盤モデルを自動的に作成することができます。既
- AI
- あとで読む
- LLM
- アルゴリズム
- 人工知能
- 開発
- 日本語
- 機械学習
- deeplearning
- 学び
中学生でもわかる深層学習
- 560 users
- speakerdeck.com/e869120
- テクノロジー
- 2024/03/29
第1章　理論編・深層学習とは (p.13-) ・ニューラルネットワークとは (p.31-) ・どうやって学習するか: 勾配降下法 (p.57-) ・深層学習の注意点 (p.91-) 第2章　応用編・分類問題 (p.110-) ・画像認識 (p.120-) ・音声認識／自然言語処理 (p.151-) ・講演のまとめ (p.167-)
- 機械学習
- あとで読む
- AI
- deeplearning
- 勉強
- 学習
- 人工知能
- 言語
- 深層学習
- study
AIはどのような仕事ができるようになったのか？ChatGPTで変わる「優秀な人材」
- 549 users
- tokoroten.medium.com
- テクノロジー
- 2023/08/17
この図はざっくりと3つの領域に分かれます。まず左下が従来のプログラミングの領域です。これは簡単に言うと﹁プログラムは間違ってはいけない定形な仕事を奪う﹂ということです。次にその上の士業が責任を取る領域です。これは﹁責任﹂を取る人がいないと成立しない仕事です。ミスが発生した際に罰則を与えるという形で、ミスの発生を防いでいます。最後に右側のホワイトカラーの仕事の領域です。ホワイトカラーの仕事は入出力が不定形であり、作業フローも非定型であったりします。そのため、多少のミスはあっても仕方ないという前提の上で仕事が行われています。機械学習がビジネスに組み込まれるにつれ、ホワイトカラーの仕事領域はそれらによって少しずつ代替されつつあります。その図がこちらになります。ホワイトカラーの担っていた領域は、表データの機械学習︵重回帰や、Lasso回帰、SVM、RandomForest、LightGBMなど
- AI
- ChatGPT
- あとで読む
- 仕事
- LLM
- 人工知能
- 機械学習
- 人材
- 学習
- work
画像生成AIの著作権問題、文化庁議論で争点はっきり (1/4)
- 512 users
- ascii.jp
- テクノロジー
- 2024/03/11
2月29日に、文化庁で﹁文化審議会著作権分科会﹂の第7回が開催されました。著作権の専門家によってその制度について議論をする場ですが、今年度は2023年7月より﹁AIと著作権﹂について議論されてきました。3月に文化庁から政府に報告する﹁AIと著作権に関する考え方について︵素案︶﹂の最終案に近いものが発表され、1月下旬から2月上旬にかけて募った﹁パブリックコメント︵パブコメ︶﹂の結果報告もされるということもあり、注目されました。登場したのは﹁AIと著作権に関する考え方について︵素案︶令和6年2月29日時点版﹂、パブコメの結果を受けて、これまでの内容に微修正が施されていました。しかし、そこからわかったのは、文化庁の一貫したスタンスでした。文化庁文化審議会著作権分科会法制度小委員会︵第7回︶パブコメへの反応は﹁素案の内容周知﹂発表物から議論を集めたのが発表資料に﹁パブコメの結果﹂が追加
- AI
- 著作権
- あとで読む
- 人工知能
- copyright
- 画像生成
- law
- 画像
- イラスト
- 議論
画像生成AIに照明革命　日本と世界で同時に“神ツール”登場 (1/3)
- 424 users
- ascii.jp
- テクノロジー
- 2024/05/27
この連載ではおなじみのキャラクター「明日来子さん」に右側からライトを当ててみた。左がIC-Lightを適用したもので、右がオリジナル。環境はWebUI Forge用の拡張機能を使用 5月8日に、「ControlNet」など画像生成AI関連の著名研究者であるイリヤスフィール（lllyasviel）さんが発表した「ICライト（Imposing Consistent Light、印象的な一貫的なライト）」が盛り上がりました。入力した画像をもとに、後から指定した照明効果を踏まえた画像を生成する技術です。画像生成AIで照明効果がつけられる「ICライト（IC-Light）」発表された学習済みモデルは、「ライトを指定すると、キャラクターのデータに合わせてテキストのプロンプトに合わせて独自に背景を生成するもの」「キャラクターとライトの影響を加味して、別の背景画像と合成するもの」の2種類があります。これ
- AI
- あとで読む
- 画像
- Stable Diffusion
- 画像生成AI
- 人工知能
- ツール
- tool
- ControlNet
- イラスト
Winnyの金子さんのED法について | やねうら王公式サイト
- 392 users
- yaneuraou.yaneu.com
- テクノロジー
- 2024/04/21
Winnyの金子勇さんが考案された機械学習アルゴリズムED法を再現して実装した人がいていま話題になっている。『Winny』の金子勇さんの失われたED法を求めて…いたら見つかりました https://qiita.com/kanekanekaneko/items/901ee2837401750dfdad いまから書くことは私の記憶頼りなので間違ってたらコメント欄で教えて欲しい。 1998年ごろだと思うのだが、私はWinnyの金子勇さんのホームページの熱心な読者だった。(ページも全部保存してたので私のHDDを漁れば出てくると思うが、すぐには出せない。) Winnyのβ版が発表されたのが2002年なのでそれよりはずいぶん前である。当時、金子さんはNekoFightという3D格闘ゲームを公開されていた。そのゲームには、自動的に対戦から学習するAIが搭載されていた。当時の金子さんのホームページの
- AI
- あとで読む
- algorithm
- 機械学習
- 人工知能
- winny
- 金子勇
- 技術
- 学習
- network
OpenAI Cookbook
- 312 users
- cookbook.openai.com
- テクノロジー
- 2023/09/23
Processing and narrating a video with GPT's visual capabilities and the TTS API
- ChatGPT
- AI
- あとで読む
- OpenAI
- LLM
- GPT
- 学習
- Python
- Deep Learning
- プログラミング
もし明日、上司に「GPT-4を作れ」と言われたら？　Stability AIのシニアリサーチサイエンティストが紹介する「LLM構築タイムアタック」
- 299 users
- logmi.jp
- テクノロジー
- 2023/12/04
オープンLLMの開発をリードする現場の視点から、開発の実情や直面する課題について発表したのは、Stability AI Japan株式会社の秋葉拓哉氏。Weights & Biasesのユーザーカンファレンス「W＆Bカンファレンス」で、LLM開発のポイントを紹介しました。全2記事。前半は、LLM構築タイムアタック。「GPT-4を作ってください」と言われたらどう答える？秋葉拓哉氏：みなさん、こんにちは。秋葉と申します。それでは、発表させていただきたいと思います。みなさん、さっそくですが、「GPT-4」ってすごいですよね。ここにいらっしゃっている方々はこれについては、もう疑いの余地なく、同意してくださるかなと思います。では、質問なんですが、もし「GPT-4を作ってください。予算はあるんだよ」と上司に言われたら、どう答えますか？　ということをちょっと聞いてみたいですね。これはけっこう意
- LLM
- AI
- あとで読む
- ChatGPT
- GPT
- 人工知能
- 画像生成AI
- 文章生成AI
- 学習
- techfeed
日本最強ユニコーンPreferred Networks、損失30億円超第9期決算 | 自動運転ラボ
- 275 users
- jidounten-lab.com
- テクノロジー
- 2023/10/07
出典‥官報︵※クリックorタップすると拡大できます︶日本を代表するユニコーン企業で、自動運転関連技術の開発も手掛けるAI︵人工知能︶開発企業の株式会社Preferred Networks︵本社‥東京都千代田区／代表取締役CEO‥西川徹︶。同社の第9期決算公告︵2022年2月〜2023年1月︶が、このほど官報に掲載された。第9期は売上高が76億5,500万円、当期純損失は30億6,600万円であった。これと同じタイミングで、同社は新設分割により、生成AI事業に関する新子会社﹁Preferred Elements﹂を2023年11月1日に設立することを発表した。2021年11月には、自律移動ロボット事業を手掛ける﹁Preferred Robotics﹂も新設分割により設立している。過去の新設分割の経緯があるため、同社の決算を過去の決算と単純に比較はしにくいが、参考のために記載すると、第7
- ai
- あとで読む
- 技術
- 企業
- 人工知能
- 日本
- 開発
- 機械学習
- 深層学習
「英語は新しいプログラミング言語であり、生成的AIは新しいコンパイラだ」。英語対応のためのSDK「English SDK for Apache Spark」をデータブリックスが発表
- 231 users
- www.publickey1.jp
- テクノロジー
- 2023/07/04
「英語は新しいプログラミング言語であり、生成的AIは新しいコンパイラだ」。英語対応のためのSDK「English SDK for Apache Spark」をデータブリックスが発表 Apache Sparkなどの開発で知られるデータブリックス社は、同社が主催したイベント「DATA+AI Summit 2023 by Databricks」で、英語をApache Sparkの問い合わせ言語にできるSDK「English SDK for Apache Spark」を発表しました。英語は新しいプログラミング言語である Databricks共同創業者兼チーフアーキテクト Reynold Xin氏。英語は新しいプログラミング言語であり、生成的AIは新しいコンパイラであり、Pythonは新しいバイトコードだ。これが何を意味するのか。多くの方々がChatGPTを使ってSparkの問い合わせコードを
【書評】Pythonによる時系列予測 | DevelopersIO
- 217 users
- dev.classmethod.jp
- テクノロジー
- 2024/01/01
こんちには。データアナリティクス事業本部機械学習チームの中村(nokomoro3)です。冬休みの個人的課題図書(自習)として﹁Pythonによる時系列予測﹂を読み終えましたので、感想と振り返りを書いておこうと思います。書籍情報以下の書籍になります。 Pythonによる時系列予測 | マイナビブックス発売 : 2023年10月翻訳本であり原著は以下となります Time Series Forecasting in Python 発売 : 2022年08月概要概要として本書に記載されていることと、記載されてないことを紹介します。記載されていること︵感想含む︶記載されていることは以下のようになっています。時系列タスクの説明トレンド、季節性、残差という3成分に分けられることの説明ランダムウォークという解けない問題の定義統計モデルMA、AR、ARMA、SARIMA、SA
LLM時代のX情報収集術｜べいえりあ
- 203 users
- note.com/csstudyabroad
- テクノロジー
- 2024/05/08
AI for Everyoneについては日本語版もあるのと、どちらのコースも日本語字幕付きで見られる︵多分機械翻訳での英語字幕からの翻訳だが、翻訳の質は悪くない︶ので、英語分からなくてある程度何とかなるんじゃないかと思います。あと、余力のある人、最新のNLP研究を理解したい人はこちらの本を読むことをオススメします。アルゴリズムの詳細は必ずしも理解しなくても良いですが、どんなタスクがあるのかは理解しておいた方が良いかと思います。 NLPの知識がLLMを応用する上で実際にどう役に立つかですが、例えばで言うとNLP的には対話の中には﹁タスク指向型対話︵task-oriented dialogue︶﹂と﹁雑談︵chit-chat dialogue︶﹂があります。それぞれ対話の中で重要視されるものから評価の仕方まで全然違うのですが、NLPをやらずにLLMをやっている人と話しているとこれらをごっちゃ
- LLM
- AI
- あとで読む
- 機械学習
- SNS
- 情報収集
- 論文
- column
- プログラミング
ChatGPTに渡す文章の適切な区切り線について検証した記事｜Clirea
- 203 users
- note.com/clirea
- テクノロジー
- 2023/09/04
はじめに大規模言語モデルであるChatGPTに文章を渡す際、適切な区切り線の使用は、情報の正確な伝達や解釈に大いに役立ちます。この記事では、区切り線に適切なものを検証します。区切り線とは？使い方区切り線は文章を区切る時に使用する文字列のことです。例えば下記のようなものです。また、使い方をまとめた記事もあるので参考にしてください。 def test() a = "a" b = "b" c = a + b print(c) ================================　←これが区切り線上記のコードについて教えてください結論先に結論を言うと、4個～16個連続した﹁-﹂か﹁=﹂もしくは8の倍数の﹁-﹂か﹁=﹂が区切り線としてはベストでした。 ---- ---------------- -------------------------------- ==== ==
- ChatGPT
- あとで読む
- AI
- GPT
- 文章
- markdown
- 機械学習
- プログラミング
- 人工知能
【2024年版】WSL2+Ubuntu24.04+Docker＋GPUでつくる機械学習環境
- 200 users
- zenn.dev/yumizz
- テクノロジー
- 2024/05/18
はじめに WSL2︵Windows Subsystem for Linux 2︶は、Microsoft Windows上でLinuxカーネルを直接実行できるようにする機能です。この記事ではWSL2環境にDockerを導入しGPUを用いた機械学習環境を構築する手順を紹介します。構築イメージは以下の図の通りです。NvidiaGPUを搭載したマシンにWSL2環境を構築します。Dockerを用いてコンテナを用意し、CUDAは各コンテナ内のCUDA Toolkitを用いて利用します。今回開発するPCのスペックは以下の通りです。 Windows 11 Windows version: 22H2 GPU‥NVIDIA Geforce RTX 3060 12GB 設定 1. WSL2を有効化デフォルトではWSL2環境が無効化されている可能性があるので、始めに有効化しておきましょう。﹁コントロール
- docker
- WSL
- あとで読む
- 機械学習
- linux
- windows
- cuda
- コンテナ
- Ubuntu
- 環境
自分がどれくらいニューラルネットワークを理解しているかを確かめられるゲーム「Graph Game」
- 196 users
- gigazine.net
- テクノロジー
- 2024/05/26
「Graph Game」はニューラルネットワークの構造をグラフで作成するゲームです。AI技術の発展と共に頻繁に目にするようになった「ニューラルネットワーク」をどの程度理解しているか試せるゲームとのことなので、実際にプレイしてみました。 Graph Game - By Sabrina Ramonov https://graphgame.sabrina.dev/ サイトにアクセスするとこんな感じ。「RNN」「LSTM Cell」「GRU Cell」「ResNet Block」「Deep RNN」という5つのステージが用意されています。まずは「RNN」をクリックしてみます。「x_t」「h_t」「y_t」という3つの箱が出現しました。それぞれの箱はデータを表しており、上が出力で下が入力となっています。「x_t」の上の○をクリックし、ドラッグして「h_t」の下に接続します。緑の線で接続が表示され
- AI
- あとで読む
- RNN
- study
- game
- 人工知能
AIの新星ニューラルネットワーク「KAN」とは？　LLMが“カンニング”して評価を盛ってた？　など重要論文5本を解説（生成AIウィークリー） | テクノエッジ TechnoEdge
- 180 users
- www.techno-edge.net
- テクノロジー
- 2024/05/06
2014年から先端テクノロジーの研究を論文単位で記事にして紹介しているWebメディアのSeamless︵シームレス︶を運営し、執筆しています。1週間分の生成AI関連論文の中から重要なものをピックアップし、解説をする連載です。第45回目は、生成AI最新論文の概要5つを紹介します。生成AI論文ピックアップ高精度なニューラルネットワーク・アーキテクチャ﹁KAN﹂をMITなどの研究者らが開発1手先のトークン予測ではなく、4手先のトークンを同時に予測するモデルをMetaなどが開発医療分野に特化したマルチモーダル大規模言語モデル﹁Med-Gemini﹂をGoogleが開発大規模言語モデルが答えに相当するベンチマークを事前に学習し、高い評価を出していた？　AIカンニング問題を指摘した研究一貫性の高い長編ビデオをテキストから生成するAIモデル﹁StoryDiffusion﹂高精度なニューラ
- AI
- あとで読む
- 人工知能
- LLM
- 論文
- 機械学習
ありがとうディープラーニングおじさん - karaage. [からあげ]
- 174 users
- karaage.hatenadiary.jp
- 政治と経済
- 2023/07/06
最初にその後のディープラーニングおじさんの話です。シンデレラの続きみたいなものなので、読まないほうが夢を壊さないかもしれませんということだけ、ここで注意喚起いたします。この記事、ずっと下書きに入ったまま公開しようか迷っていたのですが、ディープラーニングおじさんのご家族にもご了承いただき、公開することにしました。そこまで拡散は希望していないのですが、特に制限するつもりはありません︵できません︶。ディープラーニングおじさんとの出会い振り返りディープラーニングおじさん︵以下Dおじさん︶とは、今だに私のブログでトップのPV数を誇る記事の主役です。上記記事ではあっさり書いていますので、もうちょっと解像度高く思い出しながら振り返ってみたいと思います。そもそもの出会いは、社内で異動した後、たまたま隣の課にDおじさんがいたことからはじまります。Dおじさんは、私より一回り以上上の年齢︵50代後半
- AI
- あとで読む
- 仕事
- 人生
ニューラルネットワークの中身を分割してAIの動作を分析・制御する試みが成功、ニューロン単位ではなく「特徴」単位にまとめるのがポイント
- 162 users
- gigazine.net
- テクノロジー
- 2023/10/10
GoogleやAmazonが投資するAIスタートアップのAnthropicの研究チームが、ニューラルネットワークがどのように言語や画像を扱っているのかを解き明かす研究において、個々のニューロンを「特徴」と呼ばれる単位にまとめることでニューラルネットワークの中身を解釈しやすくなるという研究結果を発表しました。 Anthropic \ Decomposing Language Models Into Understandable Components https://www.anthropic.com/index/decomposing-language-models-into-understandable-components 大規模言語モデルは多数のニューロンが接続されたニューラルネットワークで、ルールに基づいてプログラミングされるのではなく、多数のデータを元にトレーニングを行うことでタス
- AI
- 人工知能
- あとで読む
- techfeed
- LLM
- Transformer
- 脳
- 機械学習
中島聡さん、NVIDIAのGPUが用済みになるって本当ですか？AI開発の行列乗算をなくす｢MatMul-free LM｣で気がかりなこと - まぐまぐニュース！
- 162 users
- www.mag2.com
- テクノロジー
- 2024/06/23
エヌビディアの強みであるGPUの優位性を揺るがすかもしれないAI関連の注目論文とは？人気急上昇中のメルマガ﹃週刊 Life is beautiful﹄より読者Q&Aをご紹介。著者の中島さんは﹁Windows95の父﹂として知られる日本人エンジニア。メルマガでは毎号、読者からの質問に丁寧に回答しています。 ※本記事のタイトル・見出しはMAG2NEWS編集部によるものですプロフィール‥中島聡︵なかじま・さとし︶ブロガー／起業家／ソフトウェア・エンジニア、工学修士︵早稲田大学︶／MBA︵ワシントン大学︶。NTT通信研究所／マイクロソフト日本法人／マイクロソフト本社勤務後、ソフトウェアベンチャーUIEvolution Inc.を米国シアトルで起業。現在は neu.Pen LLCでiPhone/iPadアプリの開発。1ビットの高速推論AIチップ　米国より先に中国が開発する可能性も読者からの質
- ai
- あとで読む
- GPU
- LLM
- 半導体
- NVIDIA
- 開発
機械学習と自動微分 (2023)
- 157 users
- speakerdeck.com/itakigawa
- テクノロジー
- 2023/09/27
「最適化法」第15回(ゲストトーク), 2023年1月20日, 同志社大学.
- 機械学習
- あとで読む
- python
- ディープラーニング
- 学習
- 統計解析
- math
- 数学
- 勉強
- AI
LLM Visualization
- 130 users
- bbycroft.net
- テクノロジー
- 2023/12/03
A 3D animated visualization of an LLM with a walkthrough.
Generative Models
- 124 users
- speakerdeck.com/takahashihiroshi
- テクノロジー
- 2024/06/13
2024年6月13日に大阪大学大学院情報科学研究科で行った「情報科学特別講義Ⅰ」の講義資料です。 https://www.ist.osaka-u.ac.jp/japanese/news/newsDetailNews.php?id=308
- AI
- あとで読む
- 機械学習
- LLM
- ML
- 研究
- 大学
- 人工知能
- Study
- 科学
金子勇さんのED法を実装してMNISTを学習させてみた - Qiita
- 121 users
- qiita.com/pocokhc
- テクノロジー
- 2024/04/20
追記：続きを書きました。はじめに先日以下の記事が投稿され、その斬新な考え方に個人的ながら衝撃を受けました。内容をざっくり言うと、ニューラルネットワークの学習を現在の主流であるBP法（誤差逆伝播法）ではなく、ED法（誤差拡散法）という新しい学習手法を提案しているものです。もし記事の内容が本当ならニューラルネットワークの学習がO(1)でできてしまう事になり、まさしく革命が起きてしまいます。（結論からいうと速度面はそこまででもなかったです（それでも早くなる可能性あり））（ただこの新手法のポテンシャルは革命を起こす可能性は秘めているといっても過言ではありません） ED法に関してネットを探すとインターネットアーカイブに情報が少し残っていました。このページですがED法のサンプルプログラム（C言語）が残っており、このサンプルプログラムをベースにpythonで書き起こしたものが本記事となりま
【AI動画生成】Animate Anyone 論文解説
- 119 users
- zenn.dev/mattyamonaca
- テクノロジー
- 2023/11/30
はじめに11月も終わり、今年も残るところあと一か月となりました。今年ももう終わるから今年中に成果を上げとけ！と言わんばかりに最近は新技術の登場が多いです。今回取り上げるのも11月最後の大砲として出てきた新技術、その名もAnimate Anyone Animate Anyoneとはなんぞや文字で説明するより見たほうが早い凄くざっくり説明すると、一枚の絵と動きをボーン動画として入力すると、入力した絵がボーン動画と同じ動きをしてくれるよ！というもの。似たようなものは今までもReferenceOnly × openpose × animatediffとかで出来ましたが、特筆すべきはその精度。動画生成の大敵であるちらつきは一切なく、入力画像にかなり忠実な動画を生成しています。さてこの技術、動画生成にずっと注目している自分としてはいますぐにでも弄り倒したいのですが、残念ながらコードとモ
- AI
- あとで読む
- 動画
- StableDiffusion
- 論文
- 人工知能
- 画像
BitNetから始める量子化入門
- 111 users
- zenn.dev/minux302
- テクノロジー
- 2024/03/03
はじめに BitNet、最近話題になっていますね。そもそも量子化って何？という方もいると思うので、この記事は DeepLearning の量子化から入り、その上で BitNet の触りについて見ていこうと思います。色々とわかってないことがあり、誤読してそうなところはそう書いてるのでご了承ください。図を作るのは面倒だったので、様々な偉大な先人様方の図やスライドを引用させていただきます。量子化 DeepLearning における量子化 DeepLearning の学習・推論は基本 float32 で行います。これを int8 や Nbit に離散化することを量子化といいます。計算に使う値は、モデルの重み、アクティベーション︵ReLUとか通した後︶、重みの勾配等があります。学習時については一旦置いておいて、この記事では推論における量子化について焦点をあてます。推論時に量子化の対象となる
自作キーボードの聖地、遊舎工房に行ってみたら、そこは沼だった（小寺信良） | テクノエッジ TechnoEdge
- 108 users
- www.techno-edge.net
- テクノロジー
- 2024/03/11
18年間テレビ番組制作者を務めたのち、文筆家として独立。家電から放送機器まで執筆・評論活動を行なう傍ら、子供の教育と保護者活動の合理化・IT化に取り組む。一般社団法人「インターネットユーザー協会」代表理事。もういい加減にしろよと読者から怒られかねないのだが、まだまだキーボードの話である。 KeychronのK11 Proを購入し、散々いじくり回していたわけだが、まあさすがに自作までは時間ないし、キーボード改造もここまでかなと思っていた。ところが先日、PFUのHHKB Studioのお話を聞く機会があり、1995年当時の秋葉原の話などが出て、懐かしく思い出した。この記事はまもなくITmedia MONOistに掲載されると思うので、お楽しみにしていただきたい。そのインタビューの中で、秋葉原のキーボード専門店「遊舎工房」の話が出て、そういえばまだ一度も行ったことないなと気づいた。だいたいこ
OpenAIのサム・アルトマンCEOが数百兆円という桁外れの資金調達を計画し「半導体業界の再構築」を目指している、すでに孫正義やUAEの有力者と会談しているとの報道も
- 90 users
- gigazine.net
- テクノロジー
- 2024/02/09
ChatGPTなどの高性能AIの開発で知られるOpenAIのサム・アルトマンCEOが、世界の半導体生産能力を拡大するために数百兆円規模の資金調達を計画していることが報じられました。 Sam Altman Seeks Trillions of Dollars to Reshape Business of Chips and AI - WSJ https://www.wsj.com/tech/ai/sam-altman-seeks-trillions-of-dollars-to-reshape-business-of-chips-and-ai-89ab3db0 文章生成AIや画像生成AIなどの開発にはGPUやAI専用チップなどの計算資源が大量に必要です。OpenAIはMicrosoftと協力して大規模なスーパーコンピューターの構築に取り組んでいますが、アルトマンCEOは公の場で「十分なサービス
- OpenAI
- 半導体
- AI
- あとで読む
- business
EV減速の中でもっとも注意すべき政策
- 87 users
- www.itmedia.co.jp
- テクノロジー
- 2024/03/11
EVシフトの減速を示すニュースが次々に発表されている。BMW、GM、フォード、テスラ、リビアン、アップルなど、多くの会社が先行きの見込みをマイナス修正。計画の先延ばしや中止など、現実に応じた修正を余儀なくされている。ただし、こうなるのはずっと前から分かっていたことで、ようやく世間が悪夢から覚めたということになるだろう。「後出しで言うな」という人が出てきそうなので、本連載の過去記事を遡（さかのぼ）ってみた。まあ本人もいったい何時からマルチパスウェイの記事を書き始めたのかよく覚えていないので、一度おさらいしてみたかったのもある。 BEVシフトが限定的であることを最初に明確に書いたのは7年前、2017年5月の「日本車はガラケーと同じ末路をたどるのか？」だ。そしてエンジンはなくならないという主張が同じ年の7月にある。「電動化に向かう時代のエンジン技術」という記事だ。現在の流れに至る原因が欧州
- BEV
- EV
- あとで読む
- car
- テスラ
- politics
- *読み物
- 自動車
畳み込みの仕組み | Convolution
- 80 users
- www.youtube.com
- テクノロジー
- 2024/01/26
確率から画像処理まで、離散畳み込みと高速フーリエ変換(FFT) 激ムズ数え上げパズルと驚きの解法 https://youtu.be/FR6_JK5thCY フーリエ変換の解説動画 https://youtu.be/fGos3wrKeHY ︻注釈︼整数のかけ算のアルゴリズムについて、FFTの"straightforward"な適用はO(N * log(n) log(log(n)) )の実行時間になる。log(log(n))の項は小さいが、2019年になってHarvey and van der Hoevenがこの項を取り除くアルゴリズムを発見した。また、O(N^2)を、必要な計算量がN^2と共に大きくなると表現したが、厳密にはこれはTheta(N^2)が意味するところである。 O(N^2)は計算量が高々N^2の定数倍になるという意味で、特に、実行時間がN^2項を持たないが有界であるアル
ファッションにおける類似商品検索アルゴリズムの性能評価 - DROBEプロダクト開発ブログ
- 80 users
- tech.drobe.co.jp
- テクノロジー
- 2023/10/17
概要背景・目的実験実験の概要定量評価定性評価おわりに参考文献 DROBEで機械学習エンジニアをしております、藤崎です。概要類似商品検索の基盤となる複数の特徴抽出アルゴリズムについて、DROBEの保有するデータで評価した定量評価によると、画像単体を入力とする ResNet-50（自己教師あり学習）とCLIPの性能が高かった定性評価によって、取り扱うモーダルの違いによる各モデル出力の顕著な差異が確認できた背景・目的小売において、商品の在庫は無数に存在しています。そのため、消費者やサービス提供者が商品に紐づく情報（画像、商品の説明文など）を解釈して、特定の商品と類似したアイテムを人手で行うのは困難です。この課題を解決するために、機械学習手法の活用が注目されています。機械学習を用いた処理の流れは、商品に紐づく情報を適切に「要約」し、 1.で「要約」した商品情
Googleが高精度かつ高速にファイル形式を判別するツール「Magika」公開
- 72 users
- pc.watch.impress.co.jp
- テクノロジー
- 2024/02/21
- google
- magika
- ツール
- python
- deepLearning
- tool
- extension
- あとで読む
大規模言語モデル
- 70 users
- speakerdeck.com/chokkan
- テクノロジー
- 2023/09/05
2023年度統計関連学会連合大会チュートリアルセッション　言語モデルと自然言語処理のフロンティア
- LLM
- AI
- Deep Learning
- ChatGPT
- 自然言語処理
- 機械学習
- あとで読む
- tutorial
グーグルのAI祭り「Google I/O 2024」基調講演を総まとめ
- 68 users
- k-tai.watch.impress.co.jp
- テクノロジー
- 2024/05/15
- AI
- あとで読む
- google
- 人工知能
- techfeed
Neural Audio Codec を用いた大規模配信文字起こしシステムの構築 - Mirrativ Tech Blog
- 65 users
- tech.mirrativ.stream
- テクノロジー
- 2024/03/04
こんにちはハタです。最近Mirrativ上に構築した配信の文字起こしシステムを紹介したいなと思います音声からの文字起こしは、各社SaaSでAPI提供されているものがあると思いますが、今回紹介するものはセルフホスト型(自前のGPUマシンを使う)になります構築していく上で色々試行錯誤したのでそれが紹介できればなと思っていますどんなものを作ったか前提知識: 配信基盤前提知識: Unix Domain Socket Live Recorder Archiver DS Filter VAD Filter NAC / Compress Transcriber NAC / Decompress Speach To Text コンテナイメージまとめ We are hiring! どんなものを作ったか今回作ったものは Mirrativで配信されるすべての音声を対象に文字起こしを行うシス
深層学習VS決定木：テーブルデータ分析の未来｜PKSHA Delta
- 60 users
- voice.pkshatech.com
- テクノロジー
- 2024/03/08
深層学習の技術が著しく進歩した結果、コンピュータビジョンや自然言語処理、音声信号処理などの分野では深層学習モデルの性能が古典的な手法のを大きく上回っており、すでにスタンダードなアプローチになっています。しかし、テーブルデータを扱うタスクにおいては、深層学習の有効性は明らかになっていません。本記事ではテーブルデータにおける従来手法と深層学習の比較論文のご紹介をしていきます。背景近年、テーブルデータを扱う深層学習モデルも登場し、一部の論文では決定木ベースのモデルと同等かそれ以上の性能を示しています。しかし、私が実務で試す中では決定木ベースのモデルの方が性能が高く、学習と推論が速く運用コストでも優れているため、深層学習モデル採用には至っていません。より一般的なテーブルデータのタスクにおける、決定木ベースモデルと深層学習モデルとの性能比較の文献を調べたところ、NeurIPS 2022で発表さ
NN研究における再現性にまつわるエトセトラ - 渋谷駅前で働くデータサイエンティストのブログ
- 59 users
- tjo.hatenablog.com
- テクノロジー
- 2023/07/25
先日、ふとしたきっかけでしましま先生*1がこちらの論文について触れられているのを見かけたのでした。これは推薦システム分野におけるNN研究の再現性について検証した2019年の論文で、近年のトップ会議*2に採択されたNN手法18個に対して再現を試みたところ、「reasonableな」努力で再現できたのはわずかに7個に過ぎず、その中でも1個は論文中で主張されたベースラインを超えることは出来なかったと報告しています。ただ、この報告はNN研究における再現性に関する議論のあくまでも一例であり、実際コロナ禍以前から「論文中ではSOTAを達成と書いているのに同じ実装をどう組んでもSOTAに達しない」みたいな業界噂話はそこかしこで耳にしたものでした。しかしながら、実際のソフトウェアやアプリケーションとしてそれらのNN手法が用いられて、尚且つその結果として何かしらの不具合でも起きない限りは、機械学習業界の
- 機械学習
- LLM
- 研究
- あとで読む
- AI
- 人工知能
- column
- 学習
WebAssemblyとWebGPUを用い、Webブラウザ上でStable Diffusion Turbo全体を高速実行可能な推論エンジン「ONNX Runtime Web 1.17」マイクロソフトから登場
- 58 users
- www.publickey1.jp
- テクノロジー
- 2024/03/08
WebAssemblyとWebGPUを用い、Webブラウザ上でStable Diffusion Turbo全体を高速実行可能な推論エンジン「ONNX Runtime Web 1.17」マイクロソフトから登場 ONNX Runtime WebがWebGPUに対応。Webブラウザ上でさらに高速な推論処理が可能になった。Stable Diffusion Turbo全体をWebブラウザ上で高速に実行可能で、RTX4090を用いた場合1秒以内で結果が出力される。 ONNX Runtime Webの基になっている「ONNX Runtime」はクロスプラットフォーム対応の推論エンジンです。TensorFlow、PyTorch、SciKit Learnなどをはじめとするさまざまな機械学習のモデルに対応し、これらで生成されたモデルによる推論処理をプラットフォームに依存せず実行するランタイムの役割を果たします
- WebAssembly
- gpu
- ブラウザ
- WebGL
- あとで読む
- browser