CycleUser
  • Homepage
  • Archives
  • About
  • 软考
  • 无人机
  • 三国对战
  • 雷电激战
  • 2048
  • 产状测量
  • 电机检测
  • 分类
    • Academic (3)
    • AI (6)
    • C (16)
    • Camera (15)
    • ChromeBook (2)
    • CUDA (1)
    • Design (1)
    • DIY (1)
    • Duke (1)
    • Education (20)
    • FuckZhihu (1)
    • Hackintosh (7)
    • Linux (4)
    • LLM (44)
    • LTFS (1)
    • Mac (3)
    • Math (30)
    • ML (4)
    • Modeling (9)
    • NAS (1)
    • Nix (1)
    • Photography (1)
    • Programming (7)
    • PVE (1)
    • Python (26)
    • QGIS (3)
    • QT (1)
    • Raspbian (1)
    • Science (2)
    • SDR (2)
    • Software (3)
    • Story (67)
    • Tool (47)
    • Tools (2)
    • Virtualization (1)
    • VirtualMachine (2)
    • Windows (1)
    • Work (24)
  • 标签
    • abbreviations (1)
    • academic (1)
    • AdamW (1)
    • advice (1)
    • aerodynamics (3)
    • Agent (1)
    • AI (28)
    • AI,Data Science (1)
    • AIGC (1)
    • airfoil (1)
    • Algorithm (12)
    • AMD (1)
    • anime (1)
    • Architecture (3)
    • arithmetic (1)
    • Attitude (2)
    • Bayesian (2)
    • Bayesian Estimation (1)
    • beginner (2)
    • 本地部署并运行omnicoder-9b的速度之谜MoXing-vs-Ollama (1)
    • binary (1)
    • 并非故意-为什么我更多用命令行工具而不是GUI (1)
    • Bioelectricity (1)
    • Book (10)
    • Brent (1)
    • C (8)
    • Camera (23)
    • career (1)
    • Causation (1)
    • 超强的本地大模型-OmniCoder-9B-简测MoXing-vs-Ollama-对比 (1)
    • 超强的本地小模型OmniCoder-9B的安装与使用指南 (1)
    • Chat (1)
    • Chou瞅-PDF论文重命名工具升级了这次专门优化了中文论文支持 (1)
    • Chou瞅一个Python小工具让你的论文PDF文件名不再是乱码 (1)
    • ChromeBook (2)
    • CLI (1)
    • Code (2)
    • Code Generation (6)
    • Coding (1)
    • Cognition (1)
    • comics (1)
    • Communicate (6)
    • communication (3)
    • comparison (1)
    • Computability (12)
    • computer (3)
    • Conda (1)
    • ConfigBack-跨平台开发配置文件的无痛备份迁移管理工具 (1)
    • 从数组到复杂数据C语言是怎么一步步变复杂的 (1)
    • CopyTalker-跨越语言障碍的近实时语音翻译 (1)
    • Correlation (1)
    • critical-thinking (1)
    • CS (1)
    • CUDA (6)
    • culture (1)
    • Cursor (1)
    • C语言复习全攻略-一文吃透所有知识点 (1)
    • C语言基础教程NumC-一个-NumPy-风格的-C-语言库 (1)
    • C语言基础教程-实现类似动态类型对用户输入解析并且选择合适的数据类型 (1)
    • C语言基础教程数组形状-50行200000列-vs-200000行50列-同样的数据不同的性能 (1)
    • 大学生 (3)
    • 大语言模型里面的token的含义和源流 (1)
    • 单精度浮点数的分辨率为什么在计算机里-1000-万和-1000-万加-001-可能是一样的 (1)
    • 单一职责原则写好Python函数的第一步 (1)
    • Data (3)
    • Data Science (2)
    • Datewise-Photo-Organizer-基于日期时间进行图片组织和路径管理的摄影辅助工具软件 (1)
    • decision-making (1)
    • Design (1)
    • 电车难题厂商的智驾会在事故前突然退出么 (1)
    • dimension (1)
    • Discuss (7)
    • Disease (1)
    • DIY (1)
    • Download (1)
    • Earth Science (1)
    • Education (15)
    • efficiency (1)
    • EKF (1)
    • emotion (1)
    • Engineering (1)
    • 耳机 (1)
    • ErTing耳听一个简单的音频降噪工具 (1)
    • Exponential Smoothing (1)
    • family (1)
    • FanFu凡赴-把-Ollama-的-GGUF-模型转成-HuggingFace-格式纯好玩 (1)
    • 方法比规模更重要AgenticQwen与Needle的小模型智能体应用探索 (1)
    • FckZhiHu (5)
    • Fibonacci (1)
    • Filtering (6)
    • FolderLens一个PySide6实现的简单文件管理器开发实例 (1)
    • fractal (1)
    • Frequency Domain (1)
    • freshman (5)
    • FuckChunWan (1)
    • FuckZhihu (1)
    • Game (2)
    • GameTheory (1)
    • GangDan-的知识库是怎么炼成的 (1)
    • GangDan-更新可用在线模型从写综述到写完整文章 (1)
    • GangDan-五月中的集中更新精准选文知识库分析学习模块全面修复 (1)
    • GangDan-又更新了一波从开发助手转型为知识管理与教学辅助工具 (1)
    • GangDan纲担升级开源本地知识库-支持本地模型和在线模型的深度研究助手 (1)
    • GangDan纲担重构-几乎重做了一遍 (1)
    • GangDan继续更新现在能直接上传CAJ构建知识库了 (1)
    • GangDan知识库导出改进-可以直接导出下载好的文章原文了 (1)
    • 高校教师建议大一开学要有电脑还要安装OpenCode使用智能体 (1)
    • 给新手实现一维数组的两种思路传统C语言-vs-NumC库 (1)
    • general-education (1)
    • GeoJsTool-地球化学分析工具-网页版的GeoPyTool (1)
    • Geology (4)
    • geometry (1)
    • GeoPython (1)
    • GIS (3)
    • GlumPy (2)
    • Golden Section (1)
    • Google-的-TurboQuant-算法如何让AI更省内存搞定向量量化难题 (1)
    • GPT-OSS (4)
    • graduate-school (1)
    • Graduate Skills (1)
    • 谷歌-TurboQuant-论文中译基于近最优扭曲率的高速在线向量量化算法 (1)
    • Guide (1)
    • Hack (2)
    • Hackintosh (4)
    • Hadoop (2)
    • Hardware (2)
    • Hate (1)
    • HBase (1)
    • HeiBan从Markdown转出PPT幻灯片 (1)
    • HeiBan黑板-将Markdown转换成HTML来当讲义 (1)
    • heroism (1)
    • History (5)
    • 换位思考和你瞅啥 (1)
    • Huan-一个把网页转换成-Markdown的Python-小工具 (1)
    • IDE (2)
    • Imbalance (1)
    • IMU (1)
    • Jacobian (1)
    • 基础知识初级统计概念的简单介绍 (1)
    • 技能设计 (1)
    • 基于本地模型的编程学习辅助环境搭建完整指南 (1)
    • 基于TUNA的-VirtualBox-与-Ubuntu-虚拟机部署指南 (1)
    • 简单说说Python里面的函数是第一公民First-Class-Citizen (1)
    • 借助Python来理解自适应辛普森积分原理实现与动态可视化 (1)
    • 旧文告别过去告别科学网 (1)
    • JiXing记行-当-Agent-对话超出上下文限制做了一个类似虚拟机热迁移草率方案 (1)
    • Job (1)
    • job-hunting (1)
    • Junck (3)
    • Kalman (1)
    • Kalman Filter (1)
    • 考研祛魅初试与复试 (1)
    • 可视化 (1)
    • Kivy (3)
    • 蓝牙 (1)
    • Learn (4)
    • learning (9)
    • Lens (19)
    • Lesson (1)
    • 利用超强的小模型-OmniCoder-9B-试试-TurboQuant-量化-KV-Cache-2-bit-挑战-FP1 (1)
    • 利用Python实现的与本地大模型交互的POSIX-兼容层 (1)
    • Liao聊-让本地大语言模型-AI-帮你聊天的开源工具 (1)
    • Library (1)
    • life (16)
    • lift (1)
    • Linux (8)
    • Literature Survey (1)
    • LlamaFactory (2)
    • LLM (5)
    • LTFS (1)
    • LTO (1)
    • Mac (11)
    • macOS (1)
    • Markdown (1)
    • Materials (1)
    • Math (3)
    • Mathematical Modeling (9)
    • mathematics (1)
    • Matplotlib (1)
    • maturity (1)
    • MayaVi (1)
    • Mechanics (1)
    • Memory (4)
    • Methodology (1)
    • 面对雾霾你是无能为力还是袖手旁观 (1)
    • 面向对象编程入门用武侠角色理解-Python-中的类 (1)
    • Microscope (2)
    • mindset (2)
    • ML (4)
    • Mobile (1)
    • Moon (1)
    • Mount&Blade (1)
    • Moving Average (1)
    • MoXing-和-Ollama-对比从omnicoder-9b到更多模型 (1)
    • MoXing-速度最高达到-Ollama的-201-同模型同硬件的实测对比OmniCoder-2-9B-的-Q4_K_M (1)
    • MoXing-五月更新算是来了个大扫除 (1)
    • MoXing-助力垃圾佬用百元超廉价显卡本地运行omnicoder-2-9b模型结果也只有十几个tokenss (1)
    • MoXing低预算场景用RX580显卡轻松运行Qwen35-9b-q4_k_m模型 (1)
    • MoXing升级同时运行多个模型实例 (1)
    • MoXing新升级直接夺舍-Ollama-部分模型提速-50 (1)
    • Muon (1)
    • n8n (1)
    • NAS (1)
    • Network (1)
    • 你的电脑每秒能做多少次浮点运算FLOPS-的故事 (1)
    • 牛顿法求解过程的Python实现及其详解 (1)
    • NixOS (1)
    • Non-Gaussian (1)
    • Nonlinear (1)
    • Nonlinear Filtering (2)
    • NumPy (1)
    • NuoYi-更新新增在线转换引擎没显卡也不怕长文档也不那么头疼 (1)
    • NuoYi-挪移更新-离线的-PDFDOCX-转-Markdown-工具稍微省一点显存了 (1)
    • NuoYi-挪移-一个离线的-PDFDOCX-转-Markdown-工具 (1)
    • Nvidia (1)
    • OCR (1)
    • Ollama (15)
    • OllamaAid给你管理本地大模型配个得力助手 (1)
    • Ollama更新所有本地模型 (1)
    • Ollama嵌入模型选型指南-主流模型深度对比 (1)
    • OPC (1)
    • OpenCL (1)
    • opencode (9)
    • OpenCode-进阶之技能创作拆解描述典型任务后验证实现再做成可复用的技能 (1)
    • OpenCode-Skills分享一套自己乱写的还算实用的-AI-编码技能库 (1)
    • OpenLaoKe-更新本地-GGUF-模型零-API-费用跑起来 (1)
    • OpenLaoKe唠嗑一个命令行AI助手 (1)
    • OpenWebUI (2)
    • Optimal Estimation (1)
    • Optimization (2)
    • os (1)
    • OSX-KVM (2)
    • Parenting (1)
    • Particle Filter (1)
    • PDF提取 (1)
    • Performance (1)
    • PHD (2)
    • philosophy (2)
    • Photo (23)
    • Photography (2)
    • Physics (3)
    • Poem (2)
    • Prerequisites (1)
    • programming (9)
    • Prompt (1)
    • Psychology (1)
    • PVE (2)
    • Pyenv (2)
    • PyOpenCL (1)
    • Python (65)
    • Python-基础语法5分钟入门 (1)
    • QEMU (1)
    • QGIS (3)
    • QT (1)
    • Qwen3 (10)
    • Radio (2)
    • RaspberryPi (1)
    • Raspbian (1)
    • reading (2)
    • reflection (4)
    • Remote (1)
    • Research (3)
    • resume (1)
    • 日常任务 (1)
    • Rotation (1)
    • RTL-SDR (2)
    • 软考高级系统架构设计师知识精要-架构师专业英语高频词汇表 (1)
    • 软考高级系统架构设计师知识精要-软件测试与运行维护 (1)
    • 软考高级系统架构设计师知识精要-软件工程与开发方法 (1)
    • 软考高级系统架构设计师知识精要-软件架构设计与评估 (1)
    • 软考高级系统架构设计师知识精要-系统安全与区块链技术 (1)
    • 软考高级系统架构设计师知识精要-系统建模与UML设计 (1)
    • 软考高级系统架构设计师知识精要-信息系统与企业信息化 (1)
    • 软考高级系统架构设计师知识精要-新兴技术与基础设施 (1)
    • Rust语言程序设计基础第三章复合数据类型与循环 (1)
    • RX590 (1)
    • SandBox (1)
    • Scholar (2)
    • School (3)
    • Science (3)
    • Search (1)
    • Self-Study (1)
    • Sequential Monte Carlo (1)
    • Server (1)
    • 商业信息 (1)
    • 世界一流大学说说而已还是真的去做 (1)
    • 使用-LLaMA-Factory-从-ModelScope-下载模型并微调 (1)
    • 使用ollama快速部署并运行最新的qwen3-30b-a3b-2507模型 (1)
    • Shit (1)
    • 数据结构与算法基础-第0章-C语言Python的底层视角 (1)
    • 数据结构与算法基础-第1章-算法基础与复杂度分析 (1)
    • 数据结构与算法基础-第2章-线性数据结构 (1)
    • 数据结构与算法基础-第4章-图论基础 (1)
    • 数据结构与算法基础-第5章-排序算法 (1)
    • 数据结构与算法基础-第6章-搜索算法 (1)
    • 数据结构与算法基础-第7章-动态规划 (1)
    • 数据结构与算法基础-第8章-高级算法 (1)
    • 数据可视化 (1)
    • 数值积分漫谈如何让用Python求积分 (1)
    • 水课幸存指南-如果你被迫要去听你不喜欢的课程该怎么办 (1)
    • Sigma Point (1)
    • Signal Processing (3)
    • skill (3)
    • Software (1)
    • 搜索 (1)
    • sports (1)
    • State Space (1)
    • Statistics (1)
    • Story (49)
    • Tape (1)
    • Telescope (1)
    • textbook (1)
    • Thinking (7)
    • 梯形法求积分的Python实现 (1)
    • 填表 (1)
    • Time Series (1)
    • Token自由-用MoXing在7900xtx-24G显卡上本地运行Qwen36-27B模型给OpenCode用来文档编 (1)
    • 统计学 (1)
    • 同门相残-百元显卡的本地模型大战RX580-16G-2048SP-VS-RX590-8G-2304SP (1)
    • Tool (8)
    • Tools (10)
    • Traffic (1)
    • Translate (2)
    • Translation (1)
    • TransPaste-升级一个剪贴板翻译工具的自我修养 (1)
    • TransPaste-一款基于本地大语言模型的轻量级剪贴板翻译工具 (1)
    • TransPaste本地-AI-翻译工具新版本升级后支持更多细粒度的翻译控制 (1)
    • TUI (1)
    • 推荐一款MarkDown的跨平台离线编辑器支持随时预览 (1)
    • TUNA (1)
    • Turing (12)
    • tutorial (2)
    • UAV (1)
    • Ubuntu (4)
    • Ubuntu-手动安装-Ollama-0171-来运行-qwen3535b-a3b-的详细指南 (1)
    • UI (1)
    • UKF (1)
    • university (14)
    • Unscented Transform (1)
    • Ventoy (1)
    • Vibe Coding (2)
    • Vibe-Coding-氛围编程案例-通过对话实现可用的快速查表工具 (1)
    • VibeCoding (1)
    • video (2)
    • VidToGif-一个简单高效的视频转-GIF-工具 (1)
    • Virtual Machine (1)
    • VirtualBox (1)
    • Virtualization (1)
    • VirtualMachine (2)
    • VisPy (1)
    • Visualization (8)
    • VM (1)
    • VMware虚拟机运行macOSunlcokrecoveryosOC4VM-实现提供百度云盘下载 (1)
    • Void-MoXing低成本方案用RX580显卡本地运行qwen359B模型打造类Cursor体验 (1)
    • VTK (1)
    • Web (1)
    • Wiener Filter (1)
    • Windows (3)
    • Windows-系统下从清华大学-TUNA-镜像安装-Miniconda3-完整指南 (1)
    • Windows11 (1)
    • WinGetGUI给-Windows-包管理器加个图形界面 (1)
    • workflow (1)
    • Xcode (1)
    • 下载 (1)
    • 先教会再让它做大模型定制化里CPT和SFT到底在干什么 (1)
    • 小猴子学编程第二回就算是孙悟空上大学也得用功 (1)
    • 小猴子学编程第三回是一直趴在那自怨自艾还是赶紧准备去新副本 (1)
    • 小猴子学编程第四回充值不会让你变强学习才会 (1)
    • 小猴子学编程第一回哪怕是孙悟空也需要学习 (1)
    • Xie写把-Markdown-转成微信公众号格式网页的小工具 (1)
    • 新手向的-Markdown-数学公式指南 (1)
    • 新手向的软考高级架构师完全备考指南 (1)
    • 修了TransPaste的4个bug (1)
    • 学习辅助 (1)
    • 学习率的前世今生从全局单一到逐层定制 (1)
    • 学术论文中常见研究方法综述及简单举例 (1)
    • 学术研究支持工具分类与文献获取方法 (1)
    • 医学场景用多模态大模型有可能完全不靠谱斯坦福大学李飞飞团队新研究揭开多模态AI的海市蜃楼效应 (1)
    • 移植Tiny-Fastboot-Script到macOS版本给Motorola-G100国行版本XT2533-4刷入G6 (1)
    • 音频 (1)
    • 用完全开源免费的本地模型来对视频中的音频进行降噪 (1)
    • 游戏是怎么运行的如果只知道充值实际上并不一定能变强 (1)
    • 这几天我穿越了时间 (1)
    • 针对大模型和智能体新手开发者的Linux环境配置指南 (1)
    • 只测-FLOPS-还不够四个经典-CPU-测试基准 (1)
    • 指针越界C语言给你的自由以及偷偷埋的雷 (1)
    • 重新审视-思维链未必是真思维-一篇ICML-2026-论文的论证与启示 (1)
    • 自用的-OpenCode-Skills-合集更新从-6-个技能到-22-个以及必须承认的问题 (1)
    • 自用的OpenCode-Skill再次更新22个skills重新打磨了一遍顺路解决了OpenCode导致整个图形界面崩溃 (1)
    • ZLUDA-和-macOS-上的-CUDA-兼容梦想 (1)
博客 › 分类: LLM
时间线
最新 ↑
  • 2026 28
    • 2025 15
      • 2024 1
        • 2026-06

          重新审视-「思维链」未必是真思维-一篇ICML 2026 论文的论证与启示

          Wed 24 June 2026 · LLM

          今天24级带佬崔总推荐了一篇 arXiv 编号2504.09762,投给ICML 2026 的这篇论文,粗略一看我以为又一篇很常见的那种「我反对一下」的文章。

          细读之后才发觉并非 …

        • Token自由-用MoXing在7900xtx-24G显卡上本地运行Qwen3.6-27B模型给OpenCode用来文档编撰润色

          Wed 10 June 2026 · LLM

          前情提要:

          MoXing:低预算场景用RX580显卡轻松运行Qwen3.5-9b-q4_k_m模型

          Void + MoXing:低成本方案用RX580显卡本地运行qwen3.5:9B模型,打造类Cursor体验

          MoXing升级:同时运行多个模型实例


          MoXing 五月更新,算是来了个大 …

        • 针对大模型和智能体新手开发者的Linux环境配置指南

          Thu 04 June 2026 · LLM

          如果你最近才开始折腾本地LLM部署或者开发AI Agent,大概率会在Windows上碰壁。这不是说Windows不能用,而是整个AI生态的“原生环境”其实是Linux。

          在Windows上跑大模型,你往往要经历WSL2的性能损耗、诡异的 …

        • 2026-05

          方法比规模更重要——AgenticQwen与Needle的小模型智能体应用探索

          Tue 26 May 2026 · LLM

          工业界一切都要考虑成本,做智能体(Agent)系统,最大的痛点其实未必是模型不够聪明,而更可能是成本过高。

          Manus、OpenClaw、Harness这些产品,背后挂的 …

        • 医学场景用多模态大模型,有可能完全不靠谱!——斯坦福大学李飞飞团队新研究揭开多模态AI的"海市蜃楼"效应

          Sun 24 May 2026 · LLM

          AI"看"见的,可能全是幻觉。

          当你给AI发了一张图,它给出了详细的分析和推理——但你有没有想过,它可能根本没在看图?


          01 一个令人不安的 …

        • 超强的本地小模型OmniCoder-9B的安装与使用指南

          Sat 16 May 2026 · LLM

          前情提要:

          超强的本地大模型 OmniCoder-9B 简测:MoXing vs Ollama 对比

          本地部署并运行omnicoder-9b的速度之谜:MoXing vs Ollama

          利用超强的小模型 OmniCoder-9B 试试 TurboQuant 量化 KV Cache: 2-bit 挑战 …

        • MoXing 助力垃圾佬用百元超廉价显卡本地运行omnicoder-2-9b模型结果也只有十几个tokens/s

          Sun 10 May 2026 · LLM

          前情提要:

          MoXing:低预算场景用RX580显卡轻松运行Qwen3.5-9b-q4_k_m模型

          Void + MoXing:低成本方案用RX580显卡本地运行qwen3.5:9B模型,打造类Cursor体验

          MoXing新升级:直接夺舍 Ollama ,部分模型提速 50%

          MoXing 和 Ollama 对比:从omnicoder-9b到更多模型

          MoXing升级:同 …

        • MoXing 速度最高达到 Ollama的 201% ,同模型同硬件的实测对比OmniCoder-2-9B 的 Q4_K_M 量化模型

          Thu 07 May 2026 · LLM

          前情提要:

          MoXing:低预算场景用RX580显卡轻松运行Qwen3.5-9b-q4_k_m模型

          Void + MoXing:低成本方案用RX580显卡本地运行qwen3.5:9B模型,打造类Cursor体验

          MoXing新升级:直接夺舍 Ollama ,部分模型提速 50%

          MoXing 和 Ollama 对比:从omnicoder-9b到更多模型

          MoXing升级:同 …

        • 先教会再让它做——大模型定制化里CPT和SFT到底在干什么

          Wed 06 May 2026 · LLM

          咱们今天聊个大模型落地时绕不开的两个东西:CPT和SFT。

          你可能听说过,大模型很厉害,什么都能聊两句。但真要把它放到医院、法 …

        • 同门相残-百元显卡的本地模型大战:RX580-16G-2048SP VS RX590-8G-2304SP

          Sun 03 May 2026 · LLM

          几年前的时候,RX580有2304SP版本,曾经是我想要申请而不得的高性能的显卡,后来有了2048SP的版本,然后最近还有一些第三方改造的16G显存的2048SP版本。

          那对比一下 …

        • 2026-04

          用完全开源免费的本地模型来对视频中的音频进行降噪

          Tue 28 April 2026 · LLM

          最近自己和一些老师都有录制教学视频,但录音设备不太行,而且录音环境页不太理想,总有一些噪音。那没办法,就想着降 …

        • JiXing(记行)-当 Agent 对话超出上下文限制,做了一个类似"虚拟机热迁移"草率方案

          Fri 24 April 2026 · LLM

          最近遇到一个实际问题:做 agent 开发时,消息长度一旦超过模型上下文限制,大多数方案都是简单粗暴地截断——后面的内容直 …

        • FanFu(凡赴 ):把 Ollama 的 GGUF 模型转成 HuggingFace 格式,纯好玩

          Thu 23 April 2026 · LLM

          起因很简单。我在 Ollama 上跑着 huihui_ai/qwen3.5-abliterated:0.8B 和 huihui_ai/lfm2.5-abliterated:latest 这两个模型,觉得挺有意思,就想着能不能把它们转成 HuggingFace 的 safetensors 格式。没别 …

        • '利用超强的小模型 OmniCoder-9B 试试 TurboQuant 量化 KV Cache: 2-bit 挑战 FP16'

          Wed 15 April 2026 · LLM

          最近几天让孩子们进行各种模型运行的探索,这个过程正好简单来测试 8 种 KV Cache 量化方案,看看对于降低显存和内存占 …

        • 2026-03

          Google 的 TurboQuant 算法如何让AI更省内存?搞定向量量化难题

          Mon 30 March 2026 · LLM

          想象一下: 你手机里存了1000张照片,现在想让AI帮你快速找到"和猫咪有关的那几张"。

          AI不是一张张看,而是把每张照片变成一串数字(这串数字就是"向量"),然后通 …

        • 谷歌 TurboQuant 论文中译:基于近最优扭曲率的高速在线向量量化算法

          Mon 30 March 2026 · LLM

          本文原文地址:arxiv.org/html/2504.19874v1

          作者:

          Amir Zandieh (Google Research),

          Majid Daliri (New York University),

          Majid Hadian (Google DeepMind),

          Vahab Mirrokni (Google Research)


          摘要

          向量量化是香农信源编码理论中的核心问 …

        • 本地部署并运行omnicoder-9b的速度之谜:MoXing vs Ollama

          Fri 27 March 2026 · LLM

          之前的测试发现 MoXing 和 Ollama 在 qwen3 系列模型上速度差不多,但在 omnicoder-9b 上差距很大。

          稍微深入调查了一下,发现关键不仅仅在于上下 …

        • 超强的本地大模型 OmniCoder-9B 简测:MoXing vs Ollama 对比

          Thu 26 March 2026 · LLM

          最近发现一个有趣的代码模型:OmniCoder-9B。这个模型基于 Qwen3.5,专门针对代码生成做了优化。

          花了一些时间用 MoXing 和 Ollama 两个工具测试 …

        • Ollama嵌入模型选型指南-主流模型深度对比

          Tue 24 March 2026 · LLM

          做RAG系统或者语义搜索的时候,嵌入模型的选择往往决定了整个系统的上限。Ollama平台上现在有十多款嵌入模型可供选择,功能定位各异,性能差距也不小。这篇文章把平台上所有的嵌入模型 …

        • MoXing 和 Ollama 对比:从omnicoder-9b到更多模型

          Mon 23 March 2026 · LLM

          最近在用本地大模型的时候,发现同样的模型在不同工具上跑起来速度差很多。我花了一些时间研究了一下 MoXing 和 Ollama 的区 …

        • OllamaAid:给你管理本地大模型配个得力助手

          Fri 20 March 2026 · LLM

          如果你正在用 Ollama 在本地跑大模型,可能会遇到这样的困惑:命令行操作虽然高效,但每次想看看有哪些模型、某个模型占用 …

        • Void + MoXing:低成本方案用RX580显卡本地运行qwen3.5:9B模型,打造类Cursor体验

          Thu 19 March 2026 · LLM

          先说在前面,这个"类Cursor体验"只能说体验上有些相似。

          Void项目(https://github.com/voideditor/void)目前似乎已停止维护,而MoXing项目(https://github.com/cycleuser/MoXing)本质上就是llama.cpp的Python封装层,整体 …

        • MoXing:低预算场景用RX580显卡轻松运行Qwen3.5-9b-q4_k_m模型

          Wed 18 March 2026 · LLM

          在大语言模型(LLM)日益普及的今天,很多人希望能在本地运行自己的模型。然而,对于使用AMD显卡的用户来说,配置ROCm环境是个令人一些同学疼的问题。而NVIDIA的显卡,价格真是让我高攀 …

        • 大语言模型里面的token的含义和源流

          Tue 10 March 2026 · LLM

          在大语言模型(Large Language Model, LLM)中,Token(令牌、词元、子词单元)是模型处理文本的最小单元。可是怎么翻译呢?今天群里一位老师就这样 …

        • Liao(聊)-让本地大语言模型 AI 帮你聊天的开源工具

          Wed 04 March 2026 · LLM

          你有没有过这样的经历:工作忙得焦头烂额,消息响个不停,回也不是不回也不是。或者有时候就是懒得打字,但又不想让朋 …

        • 2026-02

          Ubuntu 手动安装 Ollama 0.17.1 来运行 qwen3.5:35b-a3b 的详细指南

          Thu 26 February 2026 · LLM

          Qwen3.5出来了,其中Qwen3.5:30b-a3b 非常好用,适合本地设备,不过需要最新的 0.17.1 以上的版本,才可以使用 ,本文简单介绍手动在Ubuntu上的部署。

          1. 卸载 …

        • TransPaste :一款基于本地大语言模型的轻量级剪贴板翻译工具

          Thu 12 February 2026 · LLM

          在今天,我们每个人都是“多语言处理者”。无论是程序员面对英文的技术文档,研究人员研读专业的国际期刊,还是跨境电商 …

        • 利用Python实现的与本地大模型交互的POSIX 兼容层

          Sun 01 February 2026 · LLM

          这就是一个实验性质的探索工具,旨在尝试通过 POSIX 兼容层,在操作系统与本地大语言模型(LLM)之间建立初步的互动连接。

          项 …

        • 2025-11

          使用 LLaMA-Factory 从 ModelScope 下载模型并微调

          Sat 15 November 2025 · LLM

          LLaMA-Factory   是一个功能强大且易于使用的开源框架,支持对 100 多种大语言模型(LLMs)和视觉语言模型(VLMs)进行统一高效的微调。它集成 …

        • 2025-10

          基于本地模型的编程学习辅助环境搭建完整指南

          Mon 06 October 2025 · LLM

          于劲郭 于劲郭

          最近这些年接触了很多学习编程的新手同学,发现有一些学习路径可能会让学习者遇到明显瓶颈:

          •一部分 …

        • 2025-08

          Ollama模型排行榜-查看下载量、参数规模、更新时间和模型标签

          Sat 23 August 2025 · LLM

          很多朋友可能也在用Ollama来下载和管理模型,下载速度还不错,而且功能也简便,最新版本的Ollama更是提供了一个简洁的GUI,可以直接选择模型对话,还能地对模型下载位置 …

        • 真正的生产力-本地大模型编排工具n8n调用局域网上的Ollama模型

          Wed 20 August 2025 · LLM

          大模型的使用,如果仅局限于简单对话,其实是很难发挥出全部效用的,也很难构成完整的生产力。

          组织和编排才是更高效 …

        • 让大语言模型“感知世界”-通过ModelSensor 获取并传递日期、时间、位置等信息

          Tue 19 August 2025 · LLM

          现在本地部署的大模型,有可能有一个问题,就是经常是“真空中的模型”,不具备当前环境的“感知”,很难用于回答与本机或当 …

        • 本地大模型谁更强?gpt-oss:20b还是qwen3:30?借助OllamaModelTester进行批量测试!

          Mon 18 August 2025 · LLM

          上次的小模型批量测试对于需要速度的场景来说也就是可以看个乐,对于需要质量的情况来说,可能就完全不够看了。毕 …

        • 小模型谁更强?gemma3:270m还是qwen3:0.6b?借助OllamaModelTester进行批量测试!

          Sun 17 August 2025 · LLM

          谷歌好像是最近刚发了gemma3:0.27b,也就是gemma3:270m的版本,这个可是比qwen3:0.6b还要轻量级很多。 这个版本的在线测评倒是不少了,但正如之前咱们谈论过 …

        • 本地模型对决?使用8G显存的4060笔记本电脑跑模型效果到底如何?借助OllamaModelTester进行批量测试!

          Sat 16 August 2025 · LLM

          前些天,在千问的一个官方群里,有朋友询问4060笔记本显卡是否能够运行gpt-oss:20b模型,群里的一些朋友表示这几乎是不可能的。 类似地,之前关于Void编辑器搭配本地模型的一篇文章中也有读者 …

        • Void+Ollama+Qwen3-4B-2507构建本地离线AI辅助开发环境

          Mon 11 August 2025 · LLM

          之前的文章介绍了Void 编辑器, 又介绍了基于 Ollama 的 Qwen3-4B-2507 模型部署,这个模型特别轻量级,甚至可以在千元红米手机上流畅运行 …

        • 千元红米手机运行本地大模型-基于mnn chat的Qwen3-4B-2507部署指南

          Sat 09 August 2025 · LLM

          昨天千问发布了最新的Qwen3-4b-Instruct-2507 和Qwen3-4b-Thinking-2507 模型,看到千问官方群里一位群友在手机上运行,感觉很厉害,得知mnn chat就可以部署,于是就动手试试看 …

        • Qwen3-4B-2507 模型的 Ollama 部署指南

          Fri 08 August 2025 · LLM

          昨天千问发布了最新的Qwen3-4b-Instruct-2507 和Qwen3-4b-Thinking-2507 模型,有如下两个亮点:

          1.Qwen3-4B-Instruct-2507 的通用能力超越了商业闭源的小尺寸模型 GPT-4.1-nano,与中等规模的 …

        • OllamaModelManager功能更新-图形化界面快速导出导入更新删除排序本地的Ollama模型

          Wed 06 August 2025 · LLM

          OllamaModelManager[1] 是一个图形化界面工具,用于快速导出导入已经下载好的Ollama模型,新加了一个功能,可以更新和删除模型了。

          去年就写过一 …

        • Void:可以用Ollama运行本地模型辅助编程且开源免费的本地化Cursor平替

          Tue 05 August 2025 · LLM

          一直以来,我都痴迷于本地模型。

          一方面是我所在地区的网速实在不理想,另一方面是我不太信任云服务。

          最近好像有个消 …

        • Qwen3-Coder-30B-A3B-Instruct 模型的 Ollama 部署指南

          Fri 01 August 2025 · LLM

          之前随手发过使用ollama本地部署qwen3-30b-a3b-thinking_q8 以及 qwen3-30b-a3b-instruct_q8 的简单命令。

          有的朋友问是如何将刚发布不久的模型从modelscope或者huggingface转换成ollama上的文件的。

          其实思路很简单,就是下载模型,然 …

        • 2025-07

          使用ollama快速部署并运行最新的qwen3-30b-a3b-2507模型

          Thu 31 July 2025 · LLM

          qwen3最新的 qwen3-30b-a3b-2507感觉很棒,在8g显存的4060显卡上都能达到4-5tokens/s。

          Image

          顺手把gguf生成,并且转成了ollama能用的q8量化版本,然后推送到了ollama的hub上面。

          懒得折腾的同学,可以下载安装ollama,然后在终端运行下面的命令:

          ollama run …

        • 2024-09

          Ollama更新所有本地模型

          Sun 22 September 2024 · LLM

          大胖哥 大胖哥

          How to update all models #2633

          https://github.com/ollama/ollama/issues/2633

          参考Ollama的项目地址发现了 seanmavley 提供的单行指令在Shell里面运行一下就可以让Ollama更新当前所有本地模型:

          ollama list | awk 'NR>1 {print $1}' | xargs -I {} sh -c 'echo "Updating model: {}"; ollama pull {}; echo "--"' && echo …
        知识共享许可协议
        Powered by Pelican
        which takes great advantage of Python