つくりながら学ぶ!画像生成AI自作入門(Compass Data Science) [単行本]
    • つくりながら学ぶ!画像生成AI自作入門(Compass Data Science) [単行本]

    • ¥4,180126 ゴールドポイント(3%還元)
    • 在庫あり2026年9月6日日曜日までヨドバシエクストリームサービス便(無料)がお届け
つくりながら学ぶ!画像生成AI自作入門(Compass Data Science) [単行本]
画像にマウスを合わせると上部に表示

つくりながら学ぶ!画像生成AI自作入門(Compass Data Science) [単行本]

Mark Liu(著)Smoky(訳)IPUSIRON(監訳)


ゴールドポイントカード・プラスのクレジット決済で「書籍」を購入すると合計12%ゴールドポイント還元!合計12%還元書籍の購入はゴールドポイントカード・プラスのクレジット決済がお得です。
通常3%ゴールドポイント還元のところ、後日付与されるクレジット決済ポイント(1%)と特典ポイント(6%)、さらにご利用明細WEBチェックにご登録いただくと2%追加して合計12%ゴールドポイント還元!詳しくはこちら

価格:¥4,180(税込)
ゴールドポイント:126 ゴールドポイント(3%還元)(¥126相当)
フォーマット:
お届け日:在庫あり今すぐのご注文で、2026年9月6日日曜日までヨドバシエクストリームサービス便(無料)がお届けします。届け先変更]詳しくはこちら
出版社:マイナビ出版
販売開始日: 2026/07/24
お取り扱い: のお取り扱い商品です。
ご確認事項:返品不可
店舗受け取りが可能です
マルチメディアAkibaマルチメディア梅田マルチメディア博多では24時間営業時間外でもお受け取りいただけます マルチメディア池袋では朝6:00〜23:30の間、営業時間外でもお受け取りいただけます

つくりながら学ぶ!画像生成AI自作入門(Compass Data Science) の 商品概要

  • 要旨(「BOOK」データベースより)

    DALL・E3やMidjourneyなどの画像生成AIはどのようにして動くのか?その仕組みを解き明かします。文章から高解像度画像を生成するモデルを構築。プロンプトに基づいて画像を編集。画像分類を行うVision Transformer(ViT)を構築。分類、テキスト生成、画像生成に合わせてLLMを微調整。本物の画像とディープフェイクをより正確に判定する。
  • 目次

    Part 1 注意機構(Attention)とTransformerを理解する
    第1章 2つのモデルの物語:Transformerと拡散
    第2章 Transformerを構築する
    第3章 Vision Transformerで画像を分類する
    第4章 画像にキャプションを追加する

    Part 2 拡散モデル入門
    第5章 拡散モデルによる画像生成
    第6章 拡散モデルで生成する画像を制御する
    第7章 拡散モデルによる高解像度画像の生成

    Part 3 拡散モデルを用いたテキスト画像生成
    第8章 CLIP:画像とテキストの類似度を測定するモデル
    第9章 潜在拡散を用いたテキストから画像の生成
    第10章 Stable Diffusion の徹底解説

    Part 4 Transformerを用いたテキストから画像の生成
    第11章 VQGAN:画像を整数のシーケンスに変換する
    第12章 DALL-Eの最小限の実装

    Part 5 新たな展開と課題
    第13章 テキストから画像への変換における新たな展開と課題

    付録 PyTorch をインストールして、ローカルおよび Colab で GPU トレーニングを有効にする
  • 内容紹介

    画像生成AI DALL-EやMidjourneyなどの画像生成はどのようにして動くのか? 拡散モデル(DM)およびVision Transformer(ViT)をPyTorchでコード実装、AI開発に不可欠なテクニックをステップアップで習得します。文章から画像を生成できる独自のAIモデルをゼロから構築しよう!

    ・文章から高解像度画像を生成するモデルを構築
    ・プロンプトに基づいて画像を編集
    ・画像分類を行うVision Transformer(ViT)を構築
    ・分類、テキスト生成、画像生成に合わせてLLMを微調整
    ・本物の画像とディープフェイクをより正確に判定する

    文章から画像が生成される仕組みをハンズオン形式で解説。章を追うごとにTransformer ベースの画像生成モデル「ミニDALL-E」を、自分の手で一から構築します。ディープフェイク検出ではResNet50のファインチューニングにより、9 割を超える精度で実物と偽物を分類、その有効性を具体的に示します。画像生成AIの仕組みをブラックボックスのままにせず、実装を学びたい人におすすめの一冊です。
    Manning『Build a Text-to-Image Generator (from Scratch)』の翻訳書。

    Part 1 注意機構(Attention)とTransformerを理解する
    第1章 2つのモデルの物語:Transformerと拡散
    第2章 Transformerを構築する
    第3章 Vision Transformerで画像を分類する
    第4章 画像にキャプションを追加する

    Part 2 拡散モデル入門
    第5章 拡散モデルによる画像生成
    第6章 拡散モデルで生成する画像を制御する
    第7章 拡散モデルによる高解像度画像の生成

    Part 3 拡散モデルを用いたテキスト画像生成
    第8章 CLIP:画像とテキストの類似度を測定するモデル
    第9章 潜在拡散を用いたテキストから画像の生成
    第10章 Stable Diffusion の徹底解説

    Part 4 Transformerを用いたテキストから画像の生成
    第11章 VQGAN:画像を整数のシーケンスに変換する
    第12章 DALL-Eの最小限の実装

    Part 5新たな展開と課題
    第13章 テキストから画像への変換における新たな展開と課題
    付録PyTorch をインストールして、ローカルおよび Colab で GPU トレーニングを有効にする
  • 著者紹介(「BOOK著者紹介情報」より)(本データはこの書籍が刊行された当時に掲載されていたものです)

    リウ,マーク(リウ,マーク/Liu,Mark)
    ケンタッキー大学 金融学教授、金融学修士課程の創設ディレクター。ボストン・カレッジでファイナンスの博士号を取得

    Smoky(スモーキー)
    ゲーム会社他数社の代表。サイバーセキュリティと機械学習の研究がライフワーク。大学院博士課程で医用画像分析AIを研究中

    IPUSIRON(イプシロン)
    2001年に『ハッカーの教科書』(データハウス)を上梓
  • 著者について

    Mark Liu (マーク リウ)
    Mark Liu (マーク・リウ):ケンタッキー大学 金融学教授、金融学修士課程の創設ディレクター。著書に『Make Python Talk 』(No Starch Press, 2021年)、『Machine Learning, Animated』(CRC Press, 2023年)、『AlphaGo Simplified』(CRC Press, 2024 年)、『Learn Generative AI with PyTorch』(Manning, 2024 年) の4 タイトルがある。ボストン・カレッジでファイナンスの博士号を取得。『Journal of Financial Economics』、『Journal of Financial and Quantitative Analysis』、『Management Science』に研究論文を発表している。

    IPUSIRON (イプシロン)
    [監訳] IPUSIRON: 福島県相馬市在住。福島県相馬市在住。2001年に『ハッカーの教科書』(データハウス) を上梓。主な著書に『ハッキング・ラボのつくりかた 完全版』『暗号技術のすべて』(翔泳社)、共著に『「技術書」の読書術』(翔泳社) 、翻訳に『暗号解読実践ガイド』(マイナビ出版)がある。

    Smoky (スモーキー)
    [翻訳] Smoky: ゲーム会社他数社の代表。サイバーセキュリティと機械学習の研究がライフワーク。大学院博士課程で医用画像診断AIを研究中。『サイバーセキュリティの教科書』他を翻訳。

つくりながら学ぶ!画像生成AI自作入門(Compass Data Science) の商品スペック

商品仕様
出版社名:マイナビ出版
著者名:Mark Liu(著)/Smoky(訳)/IPUSIRON(監訳)
発行年月日:2026/07/24
ISBN-10:4839990298
ISBN-13:9784839990299
判型:B5
発売社名:マイナビ出版
対象:専門
発行形態:単行本
内容:電子通信
言語:日本語
ページ数:384ページ
縦:24cm
その他: 原書名: Build a Text-to-Image Generator (from Scratch):With transformers and diffusions〈Liu,Mark〉
他のマイナビ出版の書籍を探す

    マイナビ出版 つくりながら学ぶ!画像生成AI自作入門(Compass Data Science) [単行本] に関するレビューとQ&A

    商品に関するご意見やご感想、購入者への質問をお待ちしています!