1Qwen/Qwen3.8-27B6,024,467 DOWNLOADS · 14,056 LIKESQwen3.8-27B is the Qwen team's 27B-parameter vision-language model, released under Apache 2.0 as post-trained weights in Hugging Face Transformers format. The card lists compatibility with Transformers, vLLM, SGLang and TokenSpeed, with a hosted API offered separately through Qwen Cloud. It is the most liked model in today's set at 14,056 likes and about 6.0 million downloads.Qwen3.8-27B 是通义千问团队推出的 270 亿参数视觉语言模型,以 Apache 2.0 许可发布,提供 Hugging Face Transformers 格式的后训练权重。模型卡称其兼容 Transformers、vLLM、SGLang 和 TokenSpeed,另有 Qwen Cloud 提供托管 API 服务。它以 14,056 个点赞成为本期最受欢迎的模型,下载量约 600 万次。Qwen3.8-27B は Qwen チームによる 270 億パラメータの視覚言語モデルで、Apache 2.0 ライセンスの下、Hugging Face Transformers 形式の事後学習済み重みとして公開されています。モデルカードでは Transformers、vLLM、SGLang、TokenSpeed との互換性が示され、マネージド API は Qwen Cloud で別途提供されます。いいねは 14,056 件と今回の最多で、ダウンロードは約 600 万件です。
2XHToken/Spark-X2.5-4B4,755 DOWNLOADS · 563 LIKESSpark-X2.5-4B is a 4B-parameter open text-generation model from XHToken, shipped for conversational use with custom modelling code alongside the safetensors weights. Its companion project presents the Spark-X2.5 series as an attempt to push agentic capability into models that run on device. It is the newest entry here, with about 4,755 downloads and 563 likes.Spark-X2.5-4B 是 XHToken 发布的 40 亿参数开源文本生成模型,随 safetensors 权重附带自定义建模代码,面向对话场景。其配套项目将 Spark-X2.5 系列定位为把智能体能力推进到端侧模型的尝试。这是本期最新的一个条目,下载量约 4,755 次,点赞 563 个。Spark-X2.5-4B は XHToken が公開した 40 億パラメータのオープンなテキスト生成モデルで、safetensors の重みとともに独自のモデリングコードが同梱され、対話用途を想定しています。関連プロジェクトは Spark-X2.5 シリーズを、オンデバイスで動くモデルにエージェント能力を持たせる試みと位置づけています。今回で最も新しい登録で、ダウンロードは約 4,755 件、いいねは 563 件です。
3facebook/mms-300m12,464 DOWNLOADS · 263 LIKESfacebook/mms-300m is the 300 million parameter checkpoint from Meta's Massively Multilingual Speech project, pretrained with the wav2vec2 self-supervised objective on roughly 500,000 hours of audio across more than 1,400 languages. It is a base model intended to be fine-tuned for a downstream speech task and expects 16 kHz input. It shows about 12,464 downloads and 263 likes.facebook/mms-300m 是 Meta 大规模多语种语音(MMS)项目中 3 亿参数的检查点,采用 wav2vec2 自监督目标,在覆盖 1,400 多种语言、约 50 万小时的语音数据上预训练。它是需要针对下游语音任务微调的基础模型,输入音频需为 16 kHz。目前下载量约 12,464 次,点赞 263 个。facebook/mms-300m は、Meta の大規模多言語音声(MMS)プロジェクトによる 3 億パラメータのチェックポイントで、1,400 以上の言語にわたる約 50 万時間の音声を用い、wav2vec2 の自己教師あり目的関数で事前学習されています。下流の音声タスク向けに微調整して使うベースモデルで、入力は 16 kHz を前提とします。ダウンロードは約 12,464 件、いいねは 263 件です。
4distilbert/distilbert-base-uncased7,054,316 DOWNLOADS · 1,156 LIKESDistilBERT base uncased is a distilled, smaller version of BERT base that does not distinguish letter case. It is published for masked language modelling and serves mainly as a starting point for fine-tuning, which keeps it among the Hub's most used encoders at roughly 7.1 million downloads. The checkpoint carries 1,156 likes.DistilBERT base uncased 是 BERT base 的蒸馏版本,体积更小,且不区分字母大小写。它以掩码语言建模任务发布,主要用作微调的起点,因而长期位居 Hugging Face 上使用最多的编码器之列,下载量约 710 万次。该检查点获得 1,156 个点赞。DistilBERT base uncased は、BERT base を蒸留した小型版で、大文字と小文字を区別しません。マスク言語モデリング用に公開され、主にファインチューニングの出発点として使われており、約 710 万件のダウンロードで Hub でも屈指の利用実績を保っています。いいねは 1,156 件です。
5openai/clip-vit-base-patch3220,579,479 DOWNLOADS · 1,210 LIKESCLIP ViT-B/32 pairs images with free-form text labels, which lets it classify pictures into categories it was never explicitly trained on. OpenAI researchers built it to study what makes computer vision models robust, and it remains a default choice for zero-shot image classification and embeddings. At about 20.6 million downloads it is the most downloaded model in today's set, with 1,210 likes.CLIP ViT-B/32 将图像与任意文本标签对应起来,因而能把图片归入训练时未明确见过的类别。该模型由 OpenAI 研究人员开发,用于研究计算机视觉模型的稳健性来源,如今仍是零样本图像分类和图文向量表示的常用选择。它以约 2,060 万次下载位居本期首位,点赞数为 1,210。CLIP ViT-B/32 は画像と自由記述のテキストラベルを結び付けることで、明示的に学習していないカテゴリーにも画像を分類できます。OpenAI の研究者がコンピュータービジョンモデルの頑健性を調べる目的で開発したもので、現在もゼロショット画像分類や埋め込み生成の定番として使われています。ダウンロードは約 2,060 万件と今回の最多で、いいねは 1,210 件です。
2026-09-05 · SATURDAY · 13:05 PDT
1IFM/K2-Horizon-MoVA-36B-A4B1,333 DOWNLOADS · 170 LIKESIFM released the sparse member of its K2-Horizon family, a mixture-of-experts model that holds 36B parameters but runs about 4B per token, paired with mixture-of-values attention. The card claims frontier-class agentic and reasoning results at that active-parameter budget. Only the final checkpoint is out; intermediate checkpoints, data and training code are promised later.IFM 发布了 K2-Horizon 系列中的稀疏成员:一个总参数量 36B、每个 token 仅激活约 4B 的混合专家模型,并配以混合值注意力(MoVA)。模型卡称,在这样的激活参数规模下,它在智能体与推理基准上达到了前沿水平。目前仅放出最终检查点,中间检查点、数据与训练代码承诺后续公开。IFM は K2-Horizon ファミリーの疎なモデルを公開した。総パラメータ36Bのうちトークンあたり約4Bのみを使う Mixture-of-Experts 構成で、Mixture-of-Values アテンションを組み合わせている。モデルカードは、この活性パラメータ規模でエージェント系および推論系ベンチマークにおいて最前線に並ぶ結果を主張する。現時点で公開されたのは最終チェックポイントのみで、中間チェックポイントやデータ、学習コードは今後の公開を予告している。
2Jackrong/Qwopus3.8-27B-Flash-GGUF10,680 DOWNLOADS · 110 LIKESA llama.cpp-ready GGUF build of Qwopus3.8-27B-Flash, a 27B multimodal model that takes image and text input, packaged for local inference. The author has posted a warning that a flaw in second-stage reinforcement learning makes the model emit wrong indentation in some Python programs, and plans to retrain that stage. It has been pulled about 10.7k times.这是 Qwopus3.8-27B-Flash 的 GGUF 版本,可直接用于 llama.cpp 本地推理;原模型为支持图文输入的 27B 多模态模型。作者已发布警告:第二阶段强化学习存在设计缺陷,会导致模型在生成部分 Python 代码时出现错误缩进,计划重新训练该阶段。目前下载量约 1.07 万次。画像とテキストを入力できる27Bのマルチモーダルモデル Qwopus3.8-27B-Flash を、llama.cpp でそのまま動かせる GGUF 形式にまとめたもの。作者は、第2段階の強化学習の設計不備により一部の Python コード生成でインデントが崩れると警告し、同段階の再学習を予定していると告知している。ダウンロードは約1.07万件。
3lightx2v/Minimax-h3-Turbo1,185,646 DOWNLOADS · 842 LIKESLightX2V's turbo distillation of MiniMax-H3 does text-to-video, image-to-video and reference-to-video in a handful of sampling steps. At roughly 1.19M downloads it is by far the most pulled model on the board, and third-party INT8 ComfyUI repacks that fuse it into a single file are trending alongside it. A hosted studio demo is available.LightX2V 对 MiniMax-H3 做的加速蒸馏版本,可用少数几步采样完成文生视频、图生视频与参考图生视频。它以约 118.5 万次下载遥遥领先,成为本期下载量最高的模型,第三方把它融合为单文件的 INT8 ComfyUI 重打包版本也同期走热。官方还提供了在线体验的 Studio。LightX2V による MiniMax-H3 の高速蒸留版で、テキストから動画、画像から動画、参照画像から動画までを数ステップのサンプリングで生成する。ダウンロードは約118.5万件と今回の顔ぶれの中で群を抜いて多く、これを単一ファイルに統合したサードパーティ製 INT8 の ComfyUI 版も同時に注目を集めている。オンラインで試せるスタジオも用意されている。
4XHToken/Spark-X2.5-1.7B2,301 DOWNLOADS · 90 LIKESXHToken published Spark-X2.5-1.7B, a small conversational text-generation model shipped in safetensors with custom modeling code. The 1.7B size puts it in range of local and on-device deployment. It has about 2.3k downloads and 90 likes so far.XHToken 发布了 Spark-X2.5-1.7B,一个面向对话的小型文本生成模型,以 safetensors 格式提供,并附带自定义建模代码。1.7B 的体量使其适合本地与端侧部署。目前下载量约 2300 次,获赞 90。XHToken が公開した Spark-X2.5-1.7B は、safetensors 形式でカスタムのモデルコードを同梱した小型の対話向けテキスト生成モデル。1.7B という規模はローカルや端末上での実行に収まる。現時点でダウンロードは約2300件、いいねは90件。
5nvidia/Qwen3.8-Flash-Next-NVFP41,129 DOWNLOADS · 83 LIKESNVIDIA published an NVFP4 four-bit quantization of Alibaba's Qwen3.8-Flash-Next, produced with its Model Optimizer toolkit. The base is a causal language model with a vision encoder, hybrid Gated DeltaNet and sparse attention, a mixture-of-experts stack and n-gram embeddings. The quantized weights cut the memory needed to serve it.英伟达发布了阿里 Qwen3.8-Flash-Next 的 NVFP4 四位量化版本,由其 Model Optimizer 工具链生成。基础模型是一个因果语言模型,配有视觉编码器、Gated DeltaNet 与稀疏注意力的混合结构、混合专家层以及 n-gram 嵌入。量化后的权重降低了部署所需的显存开销。NVIDIA は、アリババの Qwen3.8-Flash-Next を自社の Model Optimizer で NVFP4(4ビット)量子化したモデルを公開した。ベースは視覚エンコーダ、Gated DeltaNet と疎なアテンションを組み合わせたハイブリッド構成、Mixture-of-Experts、n-gram 埋め込みを備えた因果言語モデル。量子化により推論時に必要なメモリが削減される。
2026-09-04 · FRIDAY · 13:05 PDT
1DavidAU/Qwen3.8-27B-TURBO-Fable-Cold-Fusion-735-882-Heretic-Uncensored-NM-DAU2,022 DOWNLOADS · 153 LIKESDavidAU published an uncensored 27B merge of Qwen3.8 tagged for image-text-to-text use, shipping safetensors weights through transformers. The author bills it as the first of several planned releases, with GGUF conversions and more than ten further variants in a companion repository. It is the only model on today's trending list, with 153 likes and about 2,000 downloads.DavidAU 发布了一个基于 Qwen3.8 的 270 亿参数无审查合并模型,标注为图文到文本用途,以 safetensors 权重经 transformers 加载。作者称这是系列发布中的第一个版本,配套仓库另有 GGUF 转换版本与十余个其他变体。它是今日趋势榜上唯一的模型,获得 153 个点赞和约 2,000 次下载。DavidAUは、Qwen3.8をもとにした270億パラメータの無検閲マージモデルを公開した。画像とテキストからテキストを生成する用途のタグが付き、safetensors形式の重みをtransformers経由で読み込む。作者は一連の公開の第1弾と位置づけ、関連リポジトリにはGGUF変換版と10種類以上の派生版があるとしている。本日のトレンド一覧で唯一のモデルで、153のいいねと約2,000ダウンロードを集めた。
2026-09-03 · THURSDAY · 13:06 PDT
1OpenVDN/vdn-minimax-h30 DOWNLOADS · 126 LIKESOpenVDN released VDN-Minimax-H3, which applies Video DeltaNet's hybrid attention to the MiniMax H3 video generator for what the card describes as near-lossless quality at lower cost. On eight B200 GPUs the authors report generating video faster than it plays back. Weights, code and license ship together as a text-to-video diffusers model.OpenVDN 发布 VDN-Minimax-H3,将 Video DeltaNet 的混合注意力应用于 MiniMax H3 视频生成模型,模型卡称其在降低开销的同时保持接近无损的质量。作者称在 8 张 B200 GPU 上,生成视频的速度快于播放速度。权重、代码与许可证一并发布,为 diffusers 格式的文生视频模型。OpenVDN は、Video DeltaNet のハイブリッド注意を動画生成モデル MiniMax H3 に適用した VDN-Minimax-H3 を公開した。モデルカードは、低コストでほぼ無損失の品質をうたう。B200を8基使った環境では、再生速度より速く動画を生成できると報告している。重み・コード・ライセンスがdiffusers形式のtext-to-videoモデルとして揃って提供される。
2DavidAU/Qwen3.8-27B-TURBO-Fable-Cold-Fusion-735-882-Heretic-Uncensored-NEO-CODER-MAX-MTP-GGUF39,646 DOWNLOADS · 122 LIKESDavidAU published MTP GGUF quants of a Qwen3.8 27B fine-tune the card calls TURBO, tuned to cut thinking tokens by half or more while keeping output detail. The card claims scores above 735 on ARC-C and 880 on ARC-E in 8-bit, and above 718 ARC-C at 4-bit. It has drawn nearly 40,000 downloads.DavidAU 发布了一个 Qwen3.8 27B 微调版本的 MTP GGUF 量化,模型卡称其为 TURBO,旨在将思考 token 减少一半以上而保持输出细节。卡片称其 8 位量化下 ARC-C 超过 735、ARC-E 超过 880,4 位量化下 ARC-C 也高于 718。目前下载量接近 4 万次。DavidAU は、モデルカードが TURBO と呼ぶ Qwen3.8 27B ファインチューンの MTP GGUF 量子化版を公開した。出力の詳細さを保ちつつ、思考トークンを半分以下に削ることを狙う。カードは8ビットでARC-C 735超・ARC-E 880超、4ビットでもARC-C 718超と主張する。ダウンロードは4万件近くに達している。
3AngelSlim/Hy4-preview-GGUF97,192 DOWNLOADS · 89 LIKESAngelSlim published three GGUF builds of Tencent's Hy4-preview, from a standard 4-bit Q4_K_M at 435 GiB down to about 214 GiB using the UD-IQ1_M and MIX_STQ1_0 strategies. The two smaller builds roughly halve the file size for local runs of a very large model. It is the most downloaded model in today's pool at about 97,000 downloads.AngelSlim 发布了腾讯 Hy4-preview 的三个 GGUF 版本,从 435 GiB 的标准 4 位 Q4_K_M,到采用 UD-IQ1_M 与 MIX_STQ1_0 策略、约 214 GiB 的版本。后两个版本把文件体积压缩近一半,便于在本地运行这一超大模型。它是当日候选中下载量最高的模型,约 9.7 万次。AngelSlim は、テンセントの Hy4-preview の GGUF ビルドを3種類公開した。標準的な4ビットのQ4_K_M(435GiB)から、UD-IQ1_MとMIX_STQ1_0の手法を用いた約214GiBのものまで揃う。小型の2種はファイルサイズをほぼ半減させ、超大規模モデルのローカル実行を現実的にする。ダウンロードは約9万7千件で本日の候補中最多。
2026-09-02 · WEDNESDAY · 01:04 PDT
1unsloth/Qwen3.8-27B-GGUF9,354,057 DOWNLOADS · 3,355 LIKESUnsloth published GGUF builds of Qwen3.8-27B using its Dynamic 3.0 quantization, which the model card says holds accuracy better than other leading quants. The card also notes developer-role support so the model works inside agentic tools such as Codex, and improved parsing of nested tool-call objects. The repo has 9.4M downloads and 3,355 likes.Unsloth 发布了 Qwen3.8-27B 的 GGUF 版本,采用其 Dynamic 3.0 量化方案,模型卡称其精度优于其他主流量化方法。卡片还提到新增 developer 角色支持,使模型可在 Codex 等智能体工具中使用,并改进了嵌套工具调用对象的解析。该仓库已有 940 万次下载和 3,355 个点赞。Unsloth は、独自の Dynamic 3.0 量子化を用いた Qwen3.8-27B の GGUF 版を公開した。モデルカードによれば、他の主要な量子化手法より精度の劣化が小さいという。developer ロールに対応して Codex などのエージェント型ツールで動作する点や、入れ子になったツール呼び出しの解析改善も挙げられている。ダウンロードは 940 万件、いいねは 3,355 件。
2Lightricks/LTX-2.51,232,274 DOWNLOADS · 2,488 LIKESLightricks released LTX-2.5, a video generation model published in single-file diffusion format. Its repository tags span image-to-video, text-to-video and video-to-video generation as well as audio-to-video and video-to-audio conversion. It has drawn 1.2M downloads and 2,488 likes.Lightricks 发布视频生成模型 LTX-2.5,以单文件 diffusion 格式提供权重。仓库标签涵盖图生视频、文生视频、视频转视频,以及音频转视频和视频转音频等多种任务。该模型已获得 123 万次下载和 2,488 个点赞。Lightricks は、単一ファイルの diffusion 形式で公開される動画生成モデル LTX-2.5 をリリースした。リポジトリのタグは画像から動画、テキストから動画、動画から動画の生成に加え、音声から動画、動画から音声への変換までを網羅する。ダウンロードは 123 万件、いいねは 2,488 件。
3unsloth/GLM-5.3-Flash-GGUF63,718 DOWNLOADS · 327 LIKESUnsloth released GGUF quantizations of GLM-5.3-Flash, a bilingual English and Chinese text generation model. The card directs users to a llama.cpp pull request or the Unsloth desktop app to run the files, and demonstrates a 1-bit build of the model running in that desktop UI. The repo has 63,718 downloads and 327 likes.Unsloth 发布了中英双语文本生成模型 GLM-5.3-Flash 的 GGUF 量化版本。模型卡指引用户通过其 llama.cpp 的 pull request 或 Unsloth 桌面应用来运行这些文件,并演示了在桌面界面中运行 1-bit 量化版的效果。该仓库已有 63,718 次下载和 327 个点赞。Unsloth は、英語と中国語に対応するテキスト生成モデル GLM-5.3-Flash の GGUF 量子化版を公開した。モデルカードは、実行方法として同社の llama.cpp 向けプルリクエストまたは Unsloth のデスクトップアプリを案内し、1-bit 版がそのデスクトップ UI 上で動作する様子も示している。ダウンロードは 63,718 件、いいねは 327 件。
4MiniMaxAI/MiniMax-H35,532,597 DOWNLOADS · 4,772 LIKESMiniMax published MiniMax-H3, a video generation model covering text-to-video, image-to-video and video-to-video along with joint text-to-audio-video output. The card points to hosted APIs on the company's global and China platforms, its web apps, and official prompt-writing skills on GitHub. It has 5.5M downloads and 4,772 likes.MiniMax 发布视频生成模型 MiniMax-H3,支持文生视频、图生视频、视频转视频,以及文本到音视频的联合生成。模型卡提供了公司国际版与国内平台的 API 入口、网页应用链接,以及 GitHub 上用于改进提示词写作的官方 skills。该模型已有 553 万次下载和 4,772 个点赞。MiniMax は、テキストから動画、画像から動画、動画から動画の生成に加え、テキストから音声付き動画までを扱う生成モデル MiniMax-H3 を公開した。モデルカードには、グローバル版と中国版のプラットフォームで提供される API、ウェブアプリ、さらに GitHub 上の公式プロンプト作成用 skills への案内がある。ダウンロードは 553 万件、いいねは 4,772 件。
5Qwen/Qwen3.8-Flash-Next-FP8130,451 DOWNLOADS · 181 LIKESQwen published FP8-quantized weights for the post-trained Qwen3.8-Flash-Next in Hugging Face Transformers format. The card describes fine-grained FP8 quantization with a block size of 128 and reports metrics nearly identical to the unquantized model, with compatibility across Transformers, vLLM and SGLang. It has 130,451 downloads and 181 likes.Qwen 发布了后训练版 Qwen3.8-Flash-Next 的 FP8 量化权重,采用 Hugging Face Transformers 格式。模型卡称其使用块大小为 128 的细粒度 FP8 量化,性能指标与未量化模型几乎一致,并兼容 Transformers、vLLM 与 SGLang 等推理框架。该仓库已有 130,451 次下载和 181 个点赞。Qwen は、事後学習済み Qwen3.8-Flash-Next の FP8 量子化重みを Hugging Face Transformers 形式で公開した。モデルカードによると、ブロックサイズ 128 のきめ細かな FP8 量子化を用いており、性能指標は量子化前とほぼ同等だという。Transformers、vLLM、SGLang などと互換性がある。ダウンロードは 130,451 件、いいねは 181 件。
2026-09-01 · TUESDAY · 13:05 PDT
1google/timesfm-3.0-pytorch0 DOWNLOADS · 188 LIKESGoogle Research published the official PyTorch weights and configurations for TimesFM 3.0, its pretrained time-series forecasting foundation model. The card describes a stacked mixing transformer with variate attention and releases the model under a non-commercial license. The repository has drawn 188 likes with no downloads recorded yet.谷歌研究院发布了时间序列预测基础模型 TimesFM 3.0 的官方 PyTorch 权重与配置。模型卡称其采用带变量注意力的堆叠混合 Transformer 架构,并以非商用许可发布。该仓库目前获得 188 个点赞,尚未记录下载量。Google Research が、時系列予測の基盤モデル TimesFM 3.0 の公式 PyTorch 重みと設定を公開した。モデルカードでは、変量アテンションを備えた積層ミキシング Transformer と説明され、非商用ライセンスで提供される。現在 188 件のいいねを集めており、ダウンロード数はまだ記録されていない。
2google-bert/bert-base-uncased69,651,344 DOWNLOADS · 2,831 LIKESBERT base uncased remains one of the most downloaded checkpoints on Hugging Face, logging 69,651,344 downloads and 2,831 likes. The English masked language model comes from the original 2018 BERT paper and does not distinguish case. It is distributed for PyTorch, TensorFlow, JAX, ONNX, Core ML and Rust.BERT base uncased 仍是 Hugging Face 上下载量最高的检查点之一,录得 69651344 次下载和 2831 个点赞。这一英文掩码语言模型出自 2018 年的 BERT 原始论文,不区分大小写。它同时提供 PyTorch、TensorFlow、JAX、ONNX、Core ML 与 Rust 版本。BERT base uncased は Hugging Face で最もダウンロードされているチェックポイントの一つで、ダウンロード 69,651,344 件、いいね 2,831 件を記録している。2018 年の BERT 原論文に由来する英語のマスク言語モデルで、大文字と小文字を区別しない。PyTorch、TensorFlow、JAX、ONNX、Core ML、Rust 向けに配布されている。
3sentence-transformers/all-MiniLM-L6-v2255,143,740 DOWNLOADS · 5,350 LIKESall-MiniLM-L6-v2 leads today's set with 255,143,740 downloads and 5,350 likes. The sentence-transformers model maps sentences and paragraphs into a 384-dimensional dense vector space for clustering and semantic search, and ships in PyTorch, ONNX, OpenVINO and Rust builds.all-MiniLM-L6-v2 以 255143740 次下载和 5350 个点赞位居今日榜首。这一 sentence-transformers 模型将句子与段落映射到 384 维稠密向量空间,用于聚类和语义检索,并提供 PyTorch、ONNX、OpenVINO 与 Rust 等多种构建版本。all-MiniLM-L6-v2 は、ダウンロード 255,143,740 件、いいね 5,350 件で当日の一覧の首位に立つ。sentence-transformers のこのモデルは、文や段落を 384 次元の密ベクトル空間に写像してクラスタリングや意味検索に用いるもので、PyTorch、ONNX、OpenVINO、Rust の各ビルドが提供されている。
4Momoking/Qwen3-VL-32B-Heretic-MiniMax-H3-NVFP40 DOWNLOADS · 98 LIKESThis repository re-quantizes an uncensored Qwen3-VL-32B text encoder for MiniMax-H3 video generation into mixed-precision NVFP4, cutting it to 15.7 GB so it fits on a single 16 GB card. The build is packaged for ComfyUI and has drawn 98 likes with no downloads recorded yet.该仓库把用于 MiniMax-H3 视频生成的无审查版 Qwen3-VL-32B 文本编码器重新量化为混合精度 NVFP4,体积压缩到 15.7 GB,可装入单张 16 GB 显卡。构建版本面向 ComfyUI 打包,目前获得 98 个点赞,尚未记录下载量。このリポジトリは、MiniMax-H3 による動画生成用の無検閲版 Qwen3-VL-32B テキストエンコーダーを混合精度の NVFP4 へ再量子化し、15.7 GB まで縮めて 16 GB のカード 1 枚に収まるようにしたものである。ComfyUI 向けにパッケージされており、いいねは 98 件、ダウンロード数はまだ記録されていない。
5openai-community/gpt214,502,665 DOWNLOADS · 3,502 LIKESGPT-2 is still in heavy use, with 14,502,665 downloads and 3,502 likes. The English causal language model was introduced by OpenAI in the paper Language Models are Unsupervised Multitask Learners and is distributed for PyTorch, TensorFlow, JAX, TFLite, ONNX and Rust.GPT-2 仍被大量使用,录得 14502665 次下载和 3502 个点赞。这一英文因果语言模型由 OpenAI 在论文《Language Models are Unsupervised Multitask Learners》中提出,目前提供 PyTorch、TensorFlow、JAX、TFLite、ONNX 与 Rust 版本。GPT-2 は現在も広く使われており、ダウンロード 14,502,665 件、いいね 3,502 件を記録している。OpenAI が論文「Language Models are Unsupervised Multitask Learners」で発表した英語の因果言語モデルで、PyTorch、TensorFlow、JAX、TFLite、ONNX、Rust 向けに配布されている。
2026-08-31 · MONDAY · 13:06 PDT
1deepseek-ai/DeepSeek-V4-Flash-Vision-Exp0 DOWNLOADS · 304 LIKESDeepSeek published DeepSeek-V4-Flash-Vision-Exp, the first experimental multimodal model in its V4 family, and it tops today's Hugging Face trending set with 304 likes. The release adds visual modules to the DeepSeek-V4-Flash architecture and continues training to unlock image understanding. DeepSeek says it improves substantially on multimodal agent tasks over DeepSeek-V4-Flash-0731.DeepSeek 发布 DeepSeek-V4-Flash-Vision-Exp,这是 V4 系列中的首个实验性多模态模型,以 304 个赞位居今日 Hugging Face 趋势榜首。该版本在 DeepSeek-V4-Flash 架构上加入视觉模块并继续训练,以解锁图像理解能力。官方称其多模态智能体能力较 DeepSeek-V4-Flash-0731 有明显提升。DeepSeek は V4 系列で初となる実験的なマルチモーダルモデル DeepSeek-V4-Flash-Vision-Exp を公開し、304 のいいねで本日の Hugging Face トレンド首位に立った。DeepSeek-V4-Flash のアーキテクチャに視覚モジュールを加え、追加学習によって画像理解を引き出している。同社はマルチモーダルなエージェント性能が DeepSeek-V4-Flash-0731 から大きく向上したとしている。
2Kijai/MiniMax-H3-experimental0 DOWNLOADS · 374 LIKESKijai posted experimental repacks of MiniMax-H3 for ComfyUI, which have drawn 374 likes, the most in today's set. They include a w4a8 format pairing 4-bit weights with int8 convrot activations, and an int8 convrot VAE the author says cuts decode time by about a third; both need ComfyUI 0.31.0. A four-step distilled video checkpoint and an experimental reference LoRA also ship.Kijai 发布了面向 ComfyUI 的 MiniMax-H3 实验性重打包版本,获 374 个赞,为今日榜单最高。其中包括将 4 比特权重与 int8 convrot 激活相配的 w4a8 格式,以及作者称可将解码耗时缩短约三分之一的 int8 convrot VAE,两者均需 ComfyUI 0.31.0。仓库还附带一个四步蒸馏视频权重和一个实验性参考 LoRA。Kijai は ComfyUI 向けに MiniMax-H3 の実験的な再パッケージを公開し、374 のいいねで今回の顔ぶれで最多となった。4 ビット重みと int8 convrot 活性化を組み合わせた w4a8 形式に加え、デコード時間を約 3 分の 1 短縮すると作者が述べる int8 convrot VAE を含み、いずれも ComfyUI 0.31.0 を要する。4 ステップ蒸留の動画チェックポイントと実験的な参照 LoRA も同梱される。
3incoai/GLM-5.3-Flash-DFlash27,322 DOWNLOADS · 90 LIKESInco AI released DFlash 2, a draft model for speculative decoding with GLM-5.3-Flash, which has logged 7,322 downloads. The repository is not a standalone language model: it runs inside a speculative decoding server and drafts tokens for the target model to verify. DFlash 2 is a block-diffusion drafter that predicts a whole block of tokens in a single pass.Inco AI 发布 DFlash 2,这是配合 GLM-5.3-Flash 使用的投机解码草稿模型,目前下载量为 7322 次。该仓库并非独立的语言模型:它运行在投机解码服务中,为目标模型草拟待验证的 token。DFlash 2 采用块扩散式草稿机制,一次前向即可预测整块 token。Inco AI は GLM-5.3-Flash と組み合わせる投機的デコード用のドラフトモデル DFlash 2 を公開し、ダウンロードは 7,322 件に達した。単体の言語モデルではなく、投機的デコードのサーバー内で動作し、検証を担う本体モデルのためにトークンを起草する。DFlash 2 はブロック拡散型のドラフターで、1 回の推論でトークンのブロック全体を予測する。
4DavidAU/Qwen3.8-27B-Cold-Fable-Fusion-GAIN-V1.1-732-Heretic-Uncensored-stage117 DOWNLOADS · 91 LIKESDavidAU published a first-stage Cold Fusion build on Qwen3.8-27B that has collected 91 likes on 17 downloads. The repository is tagged as an uncensored fine-tune using the Heretic method and is registered for image-text-to-text use, so it takes both images and text. Its model card is currently empty.DavidAU 发布了基于 Qwen3.8-27B 的 Cold Fusion 第一阶段版本,下载 17 次却已获得 91 个赞。仓库标注为采用 Heretic 方法的去审查微调模型,并登记为图文到文本用途,因此可同时接受图像与文本输入。目前该模型卡内容为空。DavidAU は Qwen3.8-27B をベースにした Cold Fusion の第 1 段階モデルを公開し、ダウンロード 17 件に対し 91 のいいねを集めている。リポジトリは Heretic 手法による無検閲のファインチューンとタグ付けされ、画像とテキストを入力に取る image-text-to-text 用途で登録されている。モデルカードは現時点で空である。
5ISTA-DASLab/Qwen3.8-27B-GSQ-RCO-GGUF18,665 DOWNLOADS · 88 LIKESISTA-DASLab released non-uniform GGUF quantizations of Qwen3.8-27B, the most downloaded entry in today's set at 18,665. The files are produced with the lab's GSQ and RCO methods, which mix precision across the model rather than applying a single bit width, and they ship with a vision projector for multimodal use.ISTA-DASLab 发布了 Qwen3.8-27B 的非均匀 GGUF 量化版本,以 18665 次下载成为今日榜单中下载量最高的条目。这批文件由该实验室的 GSQ 与 RCO 方法生成,在模型内部混合使用不同精度,而非统一采用单一位宽,并随附一个视觉投影器以支持多模态使用。ISTA-DASLab は Qwen3.8-27B の非一様な GGUF 量子化を公開し、18,665 件と今回の顔ぶれで最多のダウンロードを記録した。ファイルは同ラボの GSQ と RCO により生成され、単一のビット幅を一律に適用するのではなくモデル内で精度を混在させる。マルチモーダル利用のためのビジョンプロジェクターも同梱される。