KREA2で画風LoRAをつくってみる
Krea 2とMusubi Tunerを用いて、自身の絵を学習させた画風LoRAの作成過程を記録。キャプション作成のコツや学習ステップ、生成結果までをまとめています。
とあるデザイナーのテクニカルノート
Krea 2とMusubi Tunerを用いて、自身の絵を学習させた画風LoRAの作成過程を記録。キャプション作成のコツや学習ステップ、生成結果までをまとめています。
中国MiniMaxの動画生成AI MiniMax-H3。33Bで最大2K・24fps・4〜15秒の動画を32kHzステレオ音声つきで一度に生成する。仕様とファイル構成をまとめた。
環境:Codex (GPT-5.6 SOL) なんとなく触ってみたQwen-Image-Edit-Rapid-AIOが非常によかったので紹介します。 Qwen Image Editは去年末に登場して何度か触ったのですが、
環境:Claude Code(Opus 5) 視覚モデルがどの程度漫画を読み取れるのかが気になったので試作してみました。フリー素材となっている「ブラックジャックによろしく」を使って解説します。 漫画を読みながらLLMに質
環境:Claude Code(Opus 4.8) 開発の動機 AIに書かせるのではなく、アシストしてほしい、というコンセプトです。 ローカルLLMが執筆をサポートしてくれる専用のテキストエディタを試作しました。中身は「テ
環境:Claude Code(Opus 4.8) 最近リリースされたOrnith-1.0を使っていてウェブ検索に向いていることを発見したので、アプリを作成してみました。 Ornith-1.0をウェブ検索に使う Ornit
nVidiaからRTX SparkがGTC Taipeiで発表されました。ようやくローカルLLMをnVidiaのGPUで動かせるノートPCが登場しそうです。発売は今年の秋。 スペック コメント CPU 20コアArmCP
環境:Claude Code(Fable 5) 地球上の風の流れを 3D で可視化するスタンドアロンのアプリを作成しました。アメリカ政府によって止められる前のClaude CodeのFable5をぎりぎり使えました。 最
いまさらな感じですが、Vera Rubinの構成や設計思想のメモ。 LLMの推論処理の流れ LLMの推論は、大きく プレフィル(Prefill) と デコード(Decode) の2段階に分かれている。 プレフィルフェーズ
環境:Claude Code (Opus 4.8) コンテンツ制作をしていると、プレゼンの資料や動画、アプリ開発などで「ちょうどいい効果音」が必要になる場面が少なくないです。音の素材を自前で用意するのは難しく、自作するに
環境:Visual Studio Code, Codex(GPT-5.4) 今回もローカルLLMを利用したアプリを制作しました。前回はチャットアプリを作成しましたが、一問一答形式ではなく、文章をデータとして並べて俯瞰した
Gemma3から一年ぶりの新バージョン。 概要 基本情報 正式名 Gemma 4 公開日 2026年4月2日 開発会社 Google DeepMind モデル規模 31B (Dense)26B MoEE4BE2B ライセ
環境:Visual Studio Code, Claude Code(Sonnet 4.6) AIチャットアプリを作りながらローカルLLMの記憶の仕組みを作ってみました。 LM Studioなどを使ってローカルLLMを利
いよいよ本命のモデルが来た感じがしますね。ローカルモデルのスタンダードになりそうです。 Qwen3.5 Qwen3.5は、Alibabaが開発した大規模言語モデル(LLM)シリーズで、Qwen3の後継にあたる改良版。 正
環境:LTX-2.3, ComfyUI 0.16.4 イスラエルのLightricksが先日公開した動画生成AIのLTX-2.3を使ってみました。前世代モデルのLTX-2と比べて、「プロンプトの理解力の向上」、「画像から