Jaret Burkett
|
764b5064fb
|
Migrate to a new DTO for latents to carry more information that a normal tensor such as audio.
|
2026-08-30 10:30:21 -06:00 |
|
Jaret Burkett
|
2a69c1e7de
|
Add initial support for Minimax H3 VSA sparse attention
|
2026-08-30 08:24:43 -06:00 |
|
Jaret Burkett
|
683fe8afc0
|
Stability improvements to model offloading. Added D-OPSD bleed loss as well.
|
2026-08-29 11:23:47 -06:00 |
|
Jaret Burkett
|
85a6880643
|
Move the offload and quantization to the base model
|
2026-08-28 08:37:56 -06:00 |
|
Jaret Burkett
|
702254688d
|
Added legacy paths
|
2026-08-28 07:55:19 -06:00 |
|
Jaret Burkett
|
520d96aac3
|
Phase 2
|
2026-08-27 18:18:31 -06:00 |
|
Jaret Burkett
|
e8d9cf6d35
|
Models v2 - phase 0
|
2026-08-27 10:51:43 -06:00 |
|
Jaret Burkett
|
da79ebce99
|
Add D-OPSD as a distillation handeling option for MiniMax H3 ref2va
|
2026-08-26 11:06:33 -06:00 |
|
Jaret Burkett
|
89102f76dc
|
Allow user to pick if reference images are sent in the image or video reference stream for Hidream H3 ref2va
|
2026-08-19 13:32:06 -06:00 |
|
Jaret Burkett
|
afd1d92722
|
Fix issue with double sampling qwen vl video frames for hidream h3 for reference videos
|
2026-08-17 15:39:07 -06:00 |
|
Jaret Burkett
|
42dfe9c661
|
Improve video frame reader
|
2026-08-16 10:21:11 -06:00 |
|
Jaret Burkett
|
2cbc2bb097
|
On minimax h3, trim cached text embeddings to max tokens if they are longer than specified
|
2026-08-16 08:42:01 -06:00 |
|
Jaret Burkett
|
151ad0e959
|
Adjust MiniMah h3 sizing for videos to downscale to match
|
2026-08-15 07:50:42 -06:00 |
|
Jaret Burkett
|
127d6f626d
|
Rework img/video reference in Minimax H3 to more closely match the comfy ui implementation.
|
2026-08-15 07:13:54 -06:00 |
|
Jaret Burkett
|
97bf49edad
|
Add support for video references in MiniMax H3 ref2va
|
2026-08-15 06:18:09 -06:00 |
|
Jaret Burkett
|
6ea281973d
|
Add support for MiniMax H3 Ref2Vid training
|
2026-08-13 12:36:03 -06:00 |
|
Jaret Burkett
|
685ce37a8d
|
Adjust sample timestep sigmas to be model evals for h3 for 1 extra step
|
2026-08-06 19:54:04 -06:00 |
|
Jaret Burkett
|
edacd406b3
|
Handle minimax loading of non pruned model
|
2026-08-06 09:18:00 -06:00 |
|
Jaret Burkett
|
7309db4d74
|
Fix layer offloaded adaln projection layer move
|
2026-08-06 08:10:20 -06:00 |
|
Jaret Burkett
|
139a38f5bd
|
Upcast adaln pruned layers to fp32 on h3 to prevent overflow.
|
2026-08-06 07:51:15 -06:00 |
|
Jaret Burkett
|
1e1418b22c
|
Apply sigma to contrastive guidance to balance loss better. Prevent noise grads on images/non audio datasets. Prep for training adapters on MiniMax H3
|
2026-08-05 13:27:12 -06:00 |
|
Jaret Burkett
|
3afa270ab5
|
Fix audio losses for DOP and other preservation losses
|
2026-08-04 22:08:48 -06:00 |
|
Jaret Burkett
|
0f9094db95
|
Fix audio loss when doing do_guidance_loss
|
2026-08-04 21:43:31 -06:00 |
|
Jaret Burkett
|
d20a17c10e
|
Limit max tokens to 512. Allow override with model kwargs.
|
2026-08-04 07:55:21 -06:00 |
|
Jaret Burkett
|
602306da77
|
Add gradient checkpointing to vae
|
2026-08-04 07:54:51 -06:00 |
|
Jaret Burkett
|
546eb7daff
|
Look for existing models in folders recursivly
|
2026-08-03 15:39:55 -06:00 |
|
Jaret Burkett
|
d3a3f70a2a
|
Speed up quantization processing on H3
|
2026-08-03 15:21:39 -06:00 |
|
Jaret Burkett
|
88ac27fc8f
|
Handle images with MiniMax H3.
|
2026-08-03 11:58:44 -06:00 |
|
Jaret Burkett
|
bf739ff966
|
Fix issue with layer offloading with MinMax H3
|
2026-08-03 11:32:36 -06:00 |
|
Jaret Burkett
|
8502a845b1
|
Add support for MiniMax H3 T2V and I2V training
|
2026-08-03 10:17:39 -06:00 |
|