做 LLM 部署的人大多有个默认假设:量化降低了显存占用和内存带宽压力,所以推理更省电。这个假设在论文和工程实践里被反复引用,但真正直接测过的很少——大部分"量...
做 LLM 推理优化时,多数人默认"权重低比特量化 = 省电"。我用 NVML 直接读功耗测了一轮后发现:低于某个模型规模的交叉点,NF4 反而更费电;而且这个...
一个量化民工的自我折腾记录:免鉴权行情源 + 多源故障转移 + 多维评分 + 本地 Web 服务 + 定时调度,全程在 WorkBuddy 里完成,附 11 个...
做的工作:把「收盘后手工翻龙虎榜、数涨停、找题材、比行业涨跌、整理成日报」这件事,改成一条可复现的流水线。本文以2026-09-28(周一)的真实盘后数据为样本...
个人量化程序的数据量通常不算大,用 SQLite 保存行情、信号和回测结果很方便,不需要单独维护数据库服务。不过,当程序从单脚本拆成行情、策略和交易几个进程后,...
今天我们介绍一下QMT入门教程,很多人接触量化软件不知道怎么样使用,今天我给一个详细的教程,从开通,安装,到环境的配置的一个全流程
今天继续给大家更新内容的第三天,每一天的更新计划,1 算法原理,2qmt常见问题,3算法原理,4量化研报,5 ptrad常见问题,6 因子分析,7 读量化研我整...
1 算法原理,2 读量化研报,3 qmt常见问题,4 算法原理,5 ptrad常见问题,6 因子分析,7量化研报
一句话先说结论: 很多公司考核工时,并不是因为他们真相信「坐得久=产出高」,而是因为产出难量化,而工时又恰好能满足过程控制、成本核算和向上汇报的需要。它未必准确...
2026 年 9 月 17 日,PrismML(出自 Caltech 的研究团队,获 Khosla Ventures、Cerberus、Google 支持)发布...
专访对象:罗长才(GEO高级优化师、落地工程师、AIGC应用工程师、量化交易系统架构师)
做过微信客服和社群运营的人都懂,最累的不是回复,而是那些高频的小判断:这条要不要回、是不是广告、要不要转人工、这个人是不是想退款。过去靠关键词规则,对方换个说法...
整理量化打板方案时,我更愿意先画执行链,而不是先选软件。一个可落地的流程至少包括行情输入、信号判断、委托执行、撤单处理和运行监控。涨停附近变化很快,如果只写“接...
代码规范校验里,Linter 能管住确定性规则,但一些主观规范项,命名是否清晰、注释是否到位、是否符合团队约定,过去我常交给大模型判断,批量一跑既慢又贵。这一周...
代码评审如果所有 PR 一视同仁,评审精力很容易被大量低风险变更稀释,真正危险的改动反而没被重点看。这一周我用 Jev 给 PR 变更做风险初判,把高风险的挑出...
前提也要交代清楚:数字来自特定硬件(16GB 级 CUDA GPU、Q4_K_M 量化)和特定负载。官方文档专门提醒过,vLLM 原型在 DGX Spark 上...
量化链路里,策略输出的候选信号往往鱼龙混杂,其中不少是异常噪声。过去我不加区分地把它们全量送进后续复盘,噪声占用了大量计算。这一周我在复盘前加了一道 Jev 过...
量化研究员要用研报,前提是研报得先被结构化地整理进知识库。过去研报切片靠人工或大模型逐段归类,批量一多就慢又贵。这一周我把这道主题分类换成 Jev,入库效率和检...