数据中心

168 个数据集
已选筛选: JSON 清除所有筛选
RYS-Qwen3.5-27B-FP8-L 是基于 Qwen3.5-27B 的 FP8 量化版本,采用块大小为 128 的细粒度量化方法,性能与原始模型几乎一致。该模型融合了多模态学习与高效的混合架构,支持文本和图像输入,原生上下文长度可达 262,144 个token,并可通过扩展支持至超过 100 万 token。它在大规模强化学习训练中表现出色,覆盖 201 种语言,适用于多种复杂场景。
GITATTRIBUTESJINJAJSONMDSAFETENSORSTXT Apache License 2.0 30 GiB 26 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
Skywork/Matrix-Game 已完整同步
Matrix-Game是一个大规模Minecraft数据集,包含细粒度的键盘和鼠标动作标注,专为训练交互式、物理基础的世界模型而设计。该数据集可配合17B参数的扩散模型,用于生成高质量、可控的游戏世界视频,并支持对场景演化进行精细控制。
GITATTRIBUTESJSONMDPNGPTSAFETENSORS MIT License 81 GiB 29 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
MYZY-AI/Muyan-TTS 已完整同步
Muyan-TTS是一个面向播客应用的可训练文本转语音模型。它在超过10万小时的播客音频数据上进行了预训练,支持零样本高质量语音合成,并能通过短短几分钟的目标语音实现说话人自适应,从而灵活地定制个性化声音。
GITATTRIBUTESJSONMDPTHSAFETENSORS Apache License 2.0 6.8 GiB 11 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
ByteDance/Q-Insight 已完整同步
Q-Insight 是一个专注于图像质量理解的视觉语言模型,通过视觉强化学习进行训练。它基于 Qwen2.5-VL-7B-Instruct 进行微调,采用 Apache-2.0 开源协议。该模型主要面向图像质量评估(IQA)、视频质量评估(VQA)以及 AIGC 内容的理解任务。
BINGITATTRIBUTESJSONMDNPZPKLPTSAFETENSORSTXT Apache License 2.0 80 GiB 92 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
BAAI/Video-XL-2 已完整同步
Video-XL-2 是一个支持视频与文本交互的多模态模型,能够根据视频内容回答用户的问题。它针对长视频场景提供了两种效率优化策略:基于分块的预填充(chunk-based prefill)和双层 KV 缓存解码(bi-level kvs decoding),可以有效降低显存占用和响应延迟,适合处理较长视频的推理任务。
BINGITATTRIBUTESJSONMDPYSAFETENSORSTXT Apache License 2.0 15 GiB 27 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
inclusionAI/Ring-1T 已完整同步
Ring-1T 是一个万亿参数级别的开源思考模型,采用 Ling 2.0 架构,总参数量达 1 万亿,激活参数为 500 亿,支持最长 128K 的上下文窗口。该模型通过大规模可验证奖励强化学习(RLVR)训练,显著提升了自然语言推理能力,并经过 RLHF 优化使通用能力更加均衡,在数学竞赛、代码生成和逻辑推理等挑战性基准上表现领先。
GITATTRIBUTESJSONMDPYSAFETENSORS MIT License 1.8 TiB 170 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
这是一个基于 Qwen3-VL-8B-Thinking 的 8 位量化模型,支持图像到文本的生成任务,例如描述图片内容。模型采用 MLX 格式,方便在 Apple 设备上高效运行。
GITATTRIBUTESJINJAJSONMDSAFETENSORSTXT Apache License 2.0 9.2 GiB 17 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
这是一个基于 Qwen3-30B-A3B 的 GGUF 格式量化模型,支持 128K 上下文长度,采用 Unsloth Dynamic 2.0 量化技术,在保持较高精度的同时优化了运行效率。该模型可在 llama.cpp、Ollama 等框架中直接使用,并支持通过 `/think` 和 `/no_think` 指令在推理过程中切换模型的思考模式,方便多轮对话中的灵活控制。
DATGGUFGITATTRIBUTESJSONMD Apache License 2.0 395 GiB 33 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
LLaDA2.0-flash-preview 是一个基于扩散技术的语言模型,采用混合专家(MoE)架构,总参数量达1000亿,但推理时仅激活约61亿参数,显著降低了计算成本。它在代码生成、复杂数学推理以及工具调用等任务上表现突出,并在多个基准测试中展现出与同类开源模型相比更优的性能。该模型支持指令微调,适用于实际应用场景,未来还将通过强化学习进一步提升推理能力。
GITATTRIBUTESJSONMDPYSAFETENSORS Apache License 2.0 192 GiB 52 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
inclusionAI/Ling-flash-2.0 已完整同步
Ling-flash-2.0 是一款基于 MoE 架构的开源语言模型,总参数量达 100B,但每次推理仅激活约 6.1B 参数(非嵌入部分 4.8B),实现了高效计算与卓越性能的平衡。该模型在 20T+ tokens 的高质量数据上训练,并经过监督微调与多阶段强化学习优化,在复杂推理、数学、代码生成和前端开发等任务中表现出色,尤其以极小的激活参数达到了与 40B 稠密模型相当的水平。推理速度上,在 H20 硬件上可达 200+ tokens/s,并支持 128K 上下文长度,兼具高吞吐与长序列处理能力。
GITATTRIBUTESJSONMDPYSAFETENSORS MIT License 192 GiB 32 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
DeepSeek-V3.2-REAP-345B-A37B 是一个基于 DeepSeek-V3.2 高效压缩而来的稀疏混合专家(SMoE)语言模型。通过名为 REAP 的专家剪枝方法,模型在保留路由器对剩余专家独立控制的前提下,均匀剪除了 50% 的专家,参数量从 671B 压缩至 345B,每 token 仅激活 37B 参数。该模型在代码生成、数学推理、工具调用等任务上保持了近乎无损的性能,同时显著降低了内存占用和部署成本。它可直接兼容标准 vLLM 推理框架,无需额外修改,特别适合资源受限环境、本地部署及学术研究场景。
JSONMDPYSAFETENSORSTXT MIT License 323 GiB 87 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
DeepSeek-V3.2-REAP-508B-A37B 是一个基于 DeepSeek-V3.2 压缩得到的稀疏混合专家语言模型。它通过 REAP(路由器加权专家激活剪枝)方法,均匀地剪除了 25% 的专家,将总参数量从 671B 压缩至 508B,而每次推理仅激活 37B 参数。该模型在代码生成、数学推理、函数调用等任务上几乎保持了与原版相同的性能,同时显著降低了内存占用和部署成本。它兼容 vLLM 等主流推理框架,无需额外修改即可直接使用,特别适合资源受限的环境和本地部署。
JSONMDPYSAFETENSORSTXT MIT License 475 GiB 119 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
XiaomiMiMo/MiMo-V2-Flash 已完整同步
MiMo-V2-Flash 是面向文本生成与推理的大语言模型资源,镜像包含模型权重、配置和推理代码等文件,不属于可按行读取的传统数据集。
GITATTRIBUTESJSONMDPYSAFETENSORSTXT MIT License 292 GiB 157 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
LongCat-Video-Avatar 是一个统一的模型,能够根据音频驱动生成富有表现力和高度动态的角色动画。它支持多种生成模式,包括音频-文本生成视频、音频-文本-图像生成视频,以及视频延续,并且兼容单流和多流音频输入。该模型通过解耦无条件引导实现自然的人体动态,采用参考跳跃注意力避免内容重复,并利用跨块潜在拼接减少长序列中的像素退化。
BINGITATTRIBUTESJSONMDONNXPNGPTSAFETENSORSSVG MIT License 99 GiB 34 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
microsoft/TRELLIS.2-4B 已完整同步
TRELLIS.2-4B 是一个面向图像到 3D 生成的大规模模型,拥有 40 亿参数。它基于一种名为 O-Voxel 的新型稀疏体素结构,能够直接从单张图像重建或生成任意拓扑的 3D 资产,并带有完整的物理渲染(PBR)材质,包括透明与半透明效果。该模型支持最高 1536³ 分辨率的高质量输出,并采用流匹配变换器架构,生成速度快、潜空间紧凑。
GITATTRIBUTESJSONMDSAFETENSORS MIT License 15 GiB 22 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
cloudcatcher2/VCBench 已完整同步
VCBench 是一个标准化的视觉语言模型评估框架,专注于数学领域的问答任务。该数据集提供了标准评估和 GPT 辅助评估两种方式,帮助用户衡量模型在单选题和自然语言回答上的表现。评估脚本会输出整体准确率以及按问题类型细分的准确率,方便用户深入分析模型能力。
GITATTRIBUTESJSONMDPNG Apache License 2.0 99 MiB 8423 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
Skywork/Matrix-Game-2.0 已完整同步
Matrix-Game-2.0 是一个开源的实时交互式世界模型,基于扩散架构实现高效的流式视频生成。它能够以 25 FPS 的速度实时合成分钟级的高保真视频,并支持通过鼠标和键盘精确控制画面内容,实现帧级别的动态响应。该模型从视觉内容和用户动作直接预测后续帧,无需文本输入,在多种复杂场景下均表现出色。
GITATTRIBUTESJSONMDMODELPNGPTHSAFETENSORS MIT License 26 GiB 18 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
M3-Agent-Control 是一个面向智能体控制任务的数据集,采用 Apache-2.0 许可证。数据集包含模型权重(以 safetensors 格式存储)、结构化文本、二进制数据及纯文本等多种内容类型,适用于相关领域的模型训练与评估。
GITATTRIBUTESJINJAJSONMDSAFETENSORSTXT Apache License 2.0 51 GiB 26 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
VeriWeb 是面向智能体信息检索的可验证长链网页任务基准,用于评估智能体在网页环境中的搜索、证据获取和结果验证能力。
GITATTRIBUTESJSONMDMP4PNG Apache License 2.0 80 GiB 609 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00
TimesFM 是一个预训练的时间序列基础模型,专为时间序列预测任务设计。它采用仅解码器架构,在多种数据上进行了预训练,包括合成和增强数据。该模型支持 PyTorch 框架,能够处理最大上下文长度为1024、最大预测步长为256的时间序列,并提供输入归一化、连续分位数预测、翻转不变性等功能,适用于多种预测场景。
GITATTRIBUTESJSONMDSAFETENSORS Apache License 2.0 882 MiB 4 个文件 WeHub 同步于 2026-08-05 08:09:00 +00:00