とあるデザイナーのテクニカルノート

生成AIノート
  • 画像生成AI

    KREA2で画風LoRAをつくってみる

    Krea 2とMusubi Tunerを用いて、自身の絵を学習させた画風LoRAの作成過程を記録。キャプション作成のコツや学習ステップ、生成結果までをまとめています。

    2026-08-28

  • 動画生成AI

    MiniMax-H3の物理表現

    中国MiniMaxの動画生成AI MiniMax-H3。33Bで最大2K・24fps・4〜15秒の動画を32kHzステレオ音声つきで一度に生成する。仕様とファイル構成をまとめた。

    2026-08-22

  • ローカルLLM

    Qwen-Image-Edit-Rapid-AIOで鉛筆画を描かせる

    環境:Codex (GPT-5.6 SOL) なんとなく触ってみたQwen-Image-Edit-Rapid-AIOが非常によかったので紹介します。 Qwen Image Editは去年末に登場して何度か触ったのですが、

    2026-08-07

  • ローカルLLM

    ローカルLLMと会話しながら読む漫画ビューワをつくってみる

    環境:Claude Code(Opus 5) 視覚モデルがどの程度漫画を読み取れるのかが気になったので試作してみました。フリー素材となっている「ブラックジャックによろしく」を使って解説します。 漫画を読みながらLLMに質

    2026-07-31

  • ローカルLLM

    ローカルLLM支援のテキストエディタをつくる

    環境:Claude Code(Opus 4.8) 開発の動機 AIに書かせるのではなく、アシストしてほしい、というコンセプトです。 ローカルLLMが執筆をサポートしてくれる専用のテキストエディタを試作しました。中身は「テ

    2026-07-12

  • ローカルLLM

    ニュースのダッシュボードアプリをつくる

    環境:Claude Code(Opus 4.8) 最近リリースされたOrnith-1.0を使っていてウェブ検索に向いていることを発見したので、アプリを作成してみました。 Ornith-1.0をウェブ検索に使う Ornit

    2026-07-08

  • ハードウェア

    RTX Sparkのスペック

    nVidiaからRTX SparkがGTC Taipeiで発表されました。ようやくローカルLLMをnVidiaのGPUで動かせるノートPCが登場しそうです。発売は今年の秋。 スペック コメント CPU 20コアArmCP

    2026-06-14

  • ビジュアライゼーション

    地球の風を視覚化する

    環境:Claude Code(Fable 5) 地球上の風の流れを 3D で可視化するスタンドアロンのアプリを作成しました。アメリカ政府によって止められる前のClaude CodeのFable5をぎりぎり使えました。 最

    2026-06-13

  • ハードウェア

    Vera Rubinは推論プロセスに合わせて再設計されたハードウェア

    いまさらな感じですが、Vera Rubinの構成や設計思想のメモ。 LLMの推論処理の流れ LLMの推論は、大きく プレフィル(Prefill) と デコード(Decode) の2段階に分かれている。 プレフィルフェーズ

    2026-06-06

  • 音楽生成AI

    Stable Audio 3で効果音生成エディタをつくる

    環境:Claude Code (Opus 4.8) コンテンツ制作をしていると、プレゼンの資料や動画、アプリ開発などで「ちょうどいい効果音」が必要になる場面が少なくないです。音の素材を自前で用意するのは難しく、自作するに

    2026-05-30

  • ローカルLLM

    ローカルLLMチャットをノードベースにしてみた

    環境:Visual Studio Code, Codex(GPT-5.4) 今回もローカルLLMを利用したアプリを制作しました。前回はチャットアプリを作成しましたが、一問一答形式ではなく、文章をデータとして並べて俯瞰した

    2026-04-04

  • ローカルLLM

    Gemma4は日本語の文章表現がかなり自然なモデル

    Gemma3から一年ぶりの新バージョン。 概要 基本情報 正式名 Gemma 4 公開日 2026年4月2日 開発会社 Google DeepMind モデル規模 31B (Dense)26B MoEE4BE2B ライセ

    2026-04-03

  • ローカルLLM

    ローカルLLMに長期記憶を持たせたチャットアプリをつくる

    環境:Visual Studio Code, Claude Code(Sonnet 4.6) AIチャットアプリを作りながらローカルLLMの記憶の仕組みを作ってみました。 LM Studioなどを使ってローカルLLMを利

    2026-03-25

  • ローカルLLM

    Qwen3.5シリーズ

    いよいよ本命のモデルが来た感じがしますね。ローカルモデルのスタンダードになりそうです。 Qwen3.5 Qwen3.5は、Alibabaが開発した大規模言語モデル(LLM)シリーズで、Qwen3の後継にあたる改良版。 正

    2026-03-23

  • 動画生成AI

    LTX-2.3を使ってみる

    環境:LTX-2.3, ComfyUI 0.16.4 イスラエルのLightricksが先日公開した動画生成AIのLTX-2.3を使ってみました。前世代モデルのLTX-2と比べて、「プロンプトの理解力の向上」、「画像から

    2026-03-08

1234次へ →

人気記事

  • ローカルLLMを用いたWebリサーチ
  • SDXLの最適な画像サイズ
  • 【Q4_K_M】量子化の読み方【Q5_K_L】
  • ローカルLLMをLM Studioで動かしてみる
  • VS Code + ContinueでローカルLLMと一緒に文章編集する

タグ

  • ComfyUI13
  • Stable Diffusion13
  • Claude Code10
  • Visual Studio Code9
  • ローカルLLM7
  • Illustrious5
  • SDXL5
  • WAN5
  • Gemma4
  • nVidia4
  • GPU3
  • LM Studio3
  • Z-Image Turbo3
  • Codex2
  • LTX2
  • Qwen2
  • Qwen-Image2
  • RAG2
  • ゲーム2
  • Continue1

すべてのタグ →

カテゴリ

  • ローカルLLM15
  • 画像生成AI11
  • ハードウェア7
  • 動画生成AI6
  • AIコーディング5
  • 音楽生成AI3
  • Python1
  • ビジュアライゼーション1
  • 雑記1

technical-notes.com