dskjal
deeplearning カテゴリの記事一覧を表示しています。
広告
広告

res_multistep サンプラーの特徴

カテゴリ:deeplearning

続きを読む

ComfyUI の CFGNorm・Adaptive Projected Guidanceノードとは何か

カテゴリ:deeplearning

続きを読む

DDIM とオイラー法は何が違うか

カテゴリ:deeplearning

続きを読む

ComfyUI で NetaYume-Lumina-Image-2.0

カテゴリ:deeplearning

目次

続きを読む

AUTOMATIC1111 の便利な機能

カテゴリ:deeplearning

AUTOMATIC1111 は更新を停止している。以下の移行先がある。

  • ComfyUI:最もユーザーが多く最新技術がいち早く取り入れられる。AUTOMATIC1111 と互換性はない
  • sd-webui-forge-classic:SD 1.5・SDXL 専用。AUTOMATIC1111 と互換性あり
  • sd-webui-forge-neo:classic と同じ作成者で最新機能を取り入れるブランチ。すでに Qwen Image Edit・Lumina Image 2.0・Wan・SageAttention などの技術は実装済み。AUTOMATIC1111 と互換性あり

目次

続きを読む

QWEM-Anime

カテゴリ:deeplearning

続きを読む

Wan2.2 の timestep 境界 0.875 の計算

カテゴリ:deeplearning

0.875 にはならないが以下の方法で計算していると考えられる。

続きを読む

Tsukasa-Speech を Windows で GPU で動かす

カテゴリ:deeplearning

Tsukasa-Speech

デフォルトの状態ではメモリが解放されず、動作を続けると VRAM が不足するのでアプリの再起動が必要になる。

512 トークン制限があり、一度に生成できる文字数は日本語の場合 200 文字に届かない程度。

ファイルアップロードバグ

gr.Audio にはバグがあり、"Too little data for declared Content-Length" のエラーメッセージで、リファレンス音声の再アップロードに失敗する。詳細は Audio component: gradio RuntimeError: Response content shorter than Content-Length #8878 を参照。大きいファイルではエラーが起こらず、小さいファイルを再アップロードすると発生することから、キャッシュが悪さをしている可能性がある。

対処法としては

  • アプリを再起動
  • ファイルをリネームしてアップロード

続きを読む

NAG Normalized Attention Guide の原理

カテゴリ:deeplearning

続きを読む

LLM を使ったストーリー作成

カテゴリ:deeplearning

LLM を使ったストーリー作成が一発でうまくいく事はない。なので、ストーリー作成の各工程ごとにアイデア出しの補助をさせることでストーリーを作成する。

AI のべりすとは日本語が使えるが性能は高くない。無料で公開されているローカル実行できる LLM を英語で使ったり、Chat GPT を使う方が効率がいい。AI のべりすとの強みはアダルト文章を日本語で出力できることだ。

モデルについてはおすすめの日本語対応ローカル大規模言語モデルを参照。

目次

続きを読む


広告
広告