C++ 字符数组和string
一、char 数组(C 风格字符串)函数需包含头文件 include <cstring>,数组定义为 char s;,以 \0 结尾 。 长度计算: strlen(s):返回字符串有效长度(不计\0)。 注意与sizeof(s)区分,后者返回数组总字节数 。 例子: char a[6]="abcd" ...
Python datetime 时区的七个坑:naive 和 aware 相等永远为 False、utcnow 差 8 小时、pytz 冒出 +08:06
Python 的 datetime 有个很阴的设计:同一个类型既可以带时区(aware),也可以不带(naive),两种对象长得一样、方法一样,大多数时候混着用也不报错。等它出问题的时候,通常是某个定时任务早跑了八个小时,或者报表里凭空多出一天。 下面七个坑都是实跑出来的,环境 Python 3.1 ...
我用 Qt 写了一个音乐播放器:能播歌、能显示歌词,还能记住歌单
这是我写的一个音乐播放器。它麻雀虽小五脏俱全,支持播放控制、歌词同步高亮、SQLite歌单持久化。本文总结了项目结构,以及信号槽、多线程、数据库等核心代码实现,附踩坑记录。 ...
RabbitMQ、Kafka、RocketMQ 三选一?这篇把消息队列选型彻底讲透了
MQ 面试高频干货!RabbitMQ、Kafka、RocketMQ 选型深度解析,摒弃单纯参数背诵,基于业务场景推导选型方案。横向对比三大 MQ 核心能力,附带事务消息、幂等消费、消息零丢失可直接落地 Java 代码。拆解消息丢失、积压、重复消费等生产难题,附面试应答模板,掌握完整 MQ 选型方法论... ...
Python 批量导入多个 CSV 至单个 Excel 文件
日常数据处理中,经常遇到需要把一批 CSV 文件汇总到一个 Excel 工作簿的场景——每个 CSV 对应一个工作表,方便统一查看和分发。Python 原生 csv 模块可以读取数据,但要逐个写入 Excel 的不同工作表,还需要额外的写入逻辑。使用 Free Spire.XLS for Pytho ...
风控建模:量化交易之外,金融 AI 的另一条吃饭手艺
金融圈里用 AI 的不止量化交易一个行当:银行和消费金融公司每天审批的贷款背后,是另一套模型——风控评分。它和量化是两种手艺:量化赌市场,风控赌人。 ...
Pycharm社区版下载地址(2026最新,送安装、汉化、使用教程)
Pycharm 是一款 Python 专业的集成开发工具, 由知名公司 JetBrains 专门为 Python 开发量身定制。Pycharm 社区版与 Pycharm 专业版比较: 对比项目Pycharm 社区版Pycharm 专业版 费用 开源,免费 订阅收费 功能 智能代码,语法高亮,代码、本 ...
用Pandas+Pydantic搭建数据清洗与验证管道
数据清洗是每个和数据打交道的人都绕不开的日常。 无论是做分析、跑模型,还是给业务方出报表,拿到的原始数据往往都带着重复记录、缺失值、格式错误,甚至一些明显违背常识的条目。 我以前习惯每次遇到问题就临时写几行 drop_duplicates() 或 fillna(),但下次换一份数据,同样的脏法又得重 ...
CatBoost 入门指南:类别特征为什么不用 One-Hot?Python 实战与 5 个坑
XGBoost 和 LightGBM 你已经调得很熟了,但只要数据里有一堆字符串类型的类别列,就免不了一段重复劳动:pd.get_dummies() 一下炸出几百列,或者 LabelEncoder 随手写上却悄悄引入了不存在的大小关系。 CatBoost 解决的就是这一件事——类别特征可以直接喂进去 ...
Elasticsearch从0-1部署成功实战
告别简单Docker一键部署!本文基于生产3节点ES集群实战,完整拆解架构选型、系统调优、集群部署、索引设计、数据同步等全流程。分享JVM堆内存黄金配置、索引零停机切换、Canal高可靠数据同步核心技巧,汇总脑裂、OOM、磁盘只读等6大生产高频坑点及解决方案,附带标准化SOP,适配面试刷题与生产落地... ...
P6822随笔题解
本文已在博客园同步发布。 注意此为个人题解,并非转载于洛谷。 [PA 2012 Finals] Tax 题目大意 给定一个 \(n\) 个点 \(m\) 条边的无向图,定义路径的代价如下: 经过一个中间点时,代价为 \(max(\) 进入该点的边权, 离开该点的边权 \()\)。 起点 \(1\) ...
手把手带你走一遍:机器学习模型如何用FastAPI和Docker部署
你大概用过不少健康管理类的App——输入年龄、性别、BMI、血压,再填几项血液指标,它就能给出一个风险评分或健康提示。 这个评分背后,往往是一个训练好的机器学习模型在实时计算。 但模型在Jupyter Notebook里跑通,和让它变成成千上万用户都能调用的服务,中间隔着一条不小的鸿沟。 今天我们就 ...
LightGBM 入门指南:更快的梯度提升树,Python 实战
训练一个 XGBoost 模型要等十分钟,换 LightGBM 同样的数据只要一分钟,精度还差不多。这不是玄学,是两者在构造决策树的方式上有根本差异。 这篇文章解决四件事:LightGBM 为什么快、三个核心优化各自解决什么问题、Python 从训练到调参的完整代码、以及我踩过的 5 个坑。看完你能 ...
JWT 退出登录之后还能用?四种让它失效的办法,附可运行的 Python 演示
前两天帮朋友看一个后台系统,他问了个问题:用户点了「退出登录」,前端把 token 删了,但如果这个 token 之前已经被人抓包拿走,拿着它还能调接口吗? 答案是能,一直能用到它过期为止。这是 JWT 最常被问到、也最容易被忽略的一件事:JWT 本身是无状态的,服务端验的只是签名和过期时间,它不知 ...
100亿订单号如何去重
拆解100亿订单号高并发去重实战方案!对比HashSet、MySQL、Redis Set等方案优劣,敲定分布式布隆过滤器+数据库兜底最优架构。通过分片优化解决Redis大key问题,搭配多线程批量加载、Redis管道提速,百亿数据4小时完成冷启动。支持10万+QPS、延迟<10ms,精准控制0.01... ...
自托管事件分析系统的设计与实现:采集服务 + ClickHouse + Superset
分享一个开源项目的架构实践:自托管的用户行为分析系统。整体链路为 SDK 上报 → Go 采集服务 → ClickHouse → SQL/Superset 分析。Docker 安装脚本先启动演示,激活后启用真实采集。 项目地址:https://github.com/data-analyze-bi/s ...
并发编程(五):Atomic——语言层的原子性、可见性与有序性
继续使用 counter 与 ready,从语言内存模型和公开 API 规则理解 Java AtomicInteger、Go sync/atomic 与 CPython 的 Atomic 语义边界。 ...
检测数据异常值的五种统计技术
处理数据的时候,最让人头大的往往不是复杂的模型调参,而是那些藏在角落里的异常值。 你是不是也遇到过这种糟心事:明明业务逻辑看着没毛病,一跑统计指标就飘红;或者模型效果突然断崖式下跌,排查半天发现是几个极端值在捣乱。 今天我们来聊聊最常用的 5 种异常值检测方法:Z-Score、IQR、LOF、Iso ...


