模型
雷达
↩ CycleUser 博客
实时检索模型:名称、厂商、规模、激活量、类型、功能、许可、上下文、开源与否、性能评测,以及各精度显存。数据来自公开来源(Hugging Face、OpenRouter、models.dev、GitHub、ModelScope、Ollama 与开源基准),默认只显示所选列数据齐全的模型。
检索
刷新
分享链接
☾ 深色
视图
卡片
列表
排行
紧凑
显存
设备
排序
相关度
综合评测 ↓
参数量 ↓
参数量 ↑
下载 ↓
点赞 ↓
星标 ↓
上下文 ↓
创建时间 ↓
更新时间 ↓
筛选
列
字段
显存精度
重置为默认
更多
导出 JSON
导出 CSV
导出快照
导入快照
取消对比
数据源
Hugging Face
OpenRouter
models.dev
GitHub
ModelScope
Ollama
评测(LiveBench)
深度补全
筛选
仅显示数据完整
开源
厂商
全部厂商
可用显存
不限
≤8GB
≤12GB
≤16GB
≤24GB
≤32GB
≤48GB
≤64GB
≤96GB
≤128GB
来源
功能
设置
代理
自动刷新
关
60 秒
5 分钟
15 分钟
ModelScope / Ollama 无跨域头,需代理
ModelScope / Ollama 需要代理?点开看说明与一键代码
这两个站点不返回跨域头,浏览器直连会被拦(公共代理目前多不可用)。可部署一个自己的 Cloudflare Worker 作转发,然后把地址填到上面的「代理」里(形如
https://你的worker.workers.dev/?url=
)。
Worker 代码(转发任意方法/请求体,含 PUT):
export default { async fetch(req){ const u=new URL(req.url); const target=u.searchParams.get("url"); if(!target) return new Response("need ?url=",{status:400}); const init={ method:req.method, headers:{"content-type":req.headers.get("content-type")||"application/json"} }; if(req.method!=="GET"&&req.method!=="HEAD") init.body=await req.text(); const r=await fetch(target,init); return new Response(r.body,{ status:r.status, headers:{"access-control-allow-origin":"*","content-type":r.headers.get("content-type")||"application/json"} }); } };
清除全部筛选
恢复默认设置
完成
指标与数据来源说明
综合评测
取 LiveBench / Hugging Face 评测均值(均来自公开数据源)。
设备
视图为开源基准(llama.cpp,Llama 3 系列)的预填/生成 t/s,按设备分组;无基准的设备仅列公开规格。
显存
按参数量×各精度每权重字节估算(未计 KV 缓存)。默认「仅显示数据完整」= 勾选的列都有数据才显示。
KV
按 HF config.json 架构计算(层数×KV头数×head_dim×2×2字节):
KV/token
每 token 增量,
KV@上下文
跑满上下文时的 KV,
Q4+KV@上下文
为总显存。
正在加载…
已选 0 个
并排对比
清空选择
勾选卡片/行左侧方框加入对比