とあるデザイナーのテクニカルノート

生成AIノート
  • ローカルLLM

    Qwen3を使ってチャットボットに討論をさせてみた

    環境:Visual Studio Code, Claude Code(Opus 4.6), Codex(GPT5.4) チャットボット同士で会話をさせてみたかったのと、どうやって実装されるのかを知りたくて討論会のアプリを

    2026-03-07

  • ローカルLLM

    Qwen3-VLとQwen3-ASRによる動画解析

    環境:Visual Studio Code, Claude Code(Sonnet 4.6) 以前からやってみたかった視覚言語モデルによる動画の解析をやってみました。前日の試作を拡張したものになります。Qwen3-ASR

    2026-02-28

  • AIコーディング

    Qwen3-ASRを使って動画音声の文字起こしをする

    環境:Visual Studio Code, Claude Code(Sonnet 4.6) 英語学習の目的で日本語・英語の字幕を同時に並べる動画プレイヤーを作りたい、と思っていたことがありましたが、いつのまにかローカル

    2026-02-27

  • 音楽生成AI

    Audio to Audioで自作曲をアレンジする

    環境:SUNO v5 中学生から高校生の頃MIDIで作曲に挑んでいた時期がありました。ちょっとした黒歴史なんですが、当時はひとつのゲームをすべて自分で作ってみたい、という気持ちが強くて、たまに妄想ゲームのBGMも作ってい

    2026-02-20

  • AIコーディング

    ComfyUIをバックエンドに使う画像・動画生成アプリをつくる

    環境:Visual Studio Code 1.108.2, Claude Code(Opus 4.6) 前回と前々回はプロンプト生成を支援するアプリを作成しましたが、今回はそれらを統合するようなアプリをCla

    2026-02-11

  • AIコーディング

    動画生成用のプロンプト支援アプリをつくる

    環境:Claude Code 前回と同様、ローカルLLMを使って動画向けのプロンプトを生成するアプリをつくりました。今回は対話をするのではなく、解答だけを返します。LLMを完全にツールとして使いました。 使っているモデル

    2026-02-02

  • ローカルLLM

    Qwen3シリーズ

    中国アリババのQwen系LLMの第3世代のQwen3のよく使うものの分類メモ。いろいろあってわかりにくい。 テキストLLM(Qwen3) Qwen3 Qwen3はアリババのオープンソース大規模言語モデル。用途に応じた複数

    2026-02-01

  • AIコーディング

    Stable Diffusionのプロンプト支援アプリをつくる

    環境:Visual Studio Code 1.108.2, Claude Code Claude Codeの力を借りて、ローカルLLMモデルを利用したアプリ開発を始めてみました。チャットボットを作ってみたいと

    2026-01-31

  • AIコーディング

    Claude Codeで株価チャートをつくる

    環境:Visual Studio Code 1.108.2, Calude Code Claude Codeに株価チャートをつくってもらいました。 GitHub CopilotからClaude Codeへ移行 GitHu

    2026-01-30

  • 動画生成AI

    動画のアップスケールとフレーム補完

    環境:ComfyUI 0.10.0, SeedVR2 WAN2.2で生成した81フレーム(5秒)のイラスト調の動画を高画質化するテスト。AIによるアップスケールとはどんなものなんだろうか。 元画像はStableDiffu

    2026-01-26

  • 動画生成AI

    FFmpegを使って短い動画を連結する

    環境:Python 3.13.11, FFmpeg 8.0.1, WAN2.2, Z-Image Turbo WAN2.2で生成した短い動画をとりあえず通しで見てみたいことがあったので、簡単に連結する仕組みを作りました。

    2026-01-23

  • 音楽生成AI

    Audio to Audioでクラシック曲をアレンジする

    環境:SUNO v5 クラシック音楽をいろいろな曲風に変えてみる実験をしてみました。 Audio to Audio で使えるローカルの音楽生成 AI を探してみましたが、あまり良さそうなものが見つからなかったので、オンラ

    2026-01-22

  • ローカルLLM

    ローカルLLMを用いたWebリサーチ

    環境:LM Studio 0.3.37 ローカルLLMにウェブ検索をさせて新しい情報を取得させたり、まとめさせたり、調査させる方法です。今回はWebSearch-MCPをインストールし、LM Studioで利用します。

    2026-01-16

  • 動画生成AI

    WAN2.2 14Bで画像を動画に変換してみる

    環境:WAN2.2, ComfyUI 0.8.2 LTX-2でのAI動画生成が楽しかったので、有名なWAN2.2を触ってみました。AI動画生成は難しい印象がありましたが、ComfyUIのテンプレートのおかげで導入が簡単で

    2026-01-13

  • Python

    Minicondaを使ってPython環境を複数運用する

    環境:Miniconda3 AnacondaはPythonの仮想環境を作成し、それぞれを個別に管理できる標準的なソフトウェア。その最小構成版がMinicondaです。ComfyUIを複数環境で運用することを例としてみた。

    2026-01-12

← 前へ1234次へ →

人気記事

  • SDXLの最適な画像サイズ
  • ローカルLLMを用いたWebリサーチ
  • 【Q4_K_M】量子化の読み方【Q5_K_L】
  • ローカルLLMをLM Studioで動かしてみる
  • VS Code + ContinueでローカルLLMと一緒に文章編集する

タグ

  • ComfyUI13
  • Stable Diffusion13
  • Claude Code10
  • Visual Studio Code9
  • ローカルLLM7
  • Illustrious5
  • SDXL5
  • WAN5
  • Gemma4
  • nVidia4
  • GPU3
  • LM Studio3
  • Z-Image Turbo3
  • Codex2
  • LTX2
  • Qwen2
  • Qwen-Image2
  • RAG2
  • ゲーム2
  • Continue1

すべてのタグ →

カテゴリ

  • ローカルLLM14
  • 画像生成AI12
  • ハードウェア7
  • 動画生成AI6
  • AIコーディング5
  • 音楽生成AI3
  • Python1
  • ビジュアライゼーション1
  • 雑記1

technical-notes.com