术→技巧

AI 时代个人站长做内容还是做工具?

在 AI 时代,个人站长选内容网站还是工具网站,这是一个很难回答的问题。因为纯信息整合型内容网站贬值最快,纯通用工具网站容易被大模型功能吞噬。 内容网站:还有机会,但门槛变了 挑战 搜索引擎流量被 AI 搜索、AI Overview、Cha…

产品 ·
0 0 138

TimesFM:谷歌开源时序预测模型解析

TimesFM简介 长期以来时间序列预测还停留在"一个任务一套模型"的阶段,每次换数据集都要重新来过。2024年,Google Research推出了TimesFM(Time Series Foundation Model),将大语言模型"…

器→工具 ·
0 0 181

LightGBM 二分类概率校准问题修复实践

构建 LightGBM 二分类模型,数据存在类别不平衡(正样本率 < 30%),模型排序能力正常(AUC 合理),但预测概率系统性偏高——预测均值远大于实际正样本率,整体偏差显著。 诊断方法:分箱校准统计 按固定步长(如 0.05)对…

数据 ·
0 0 189

变量分箱与自然分组实践总结

在数据分析与建模中,我们经常遇到两类变量处理难题: 连续变量(如距离、时长、金额、温度):取值范围连续,直接使用可能导致模型过拟合,且难以输出可解释的业务结论。例如"距离7km"不如"中途(15-30km)"直观。 高基数类别变量(如小时、…

数据 ·
0 0 189

Tauri vs Electron:桌面应用框架选型指南

在开发HTML和Markdown文件管理工具的时候,遇到的了如何选择应用框架的问题,于是使用了Deepseek对Tauri和 Electron初步的了解与对比。以下内容主要来自Deepseek。个人只是做了简单的梳理与完善。 为什么是这两个…

术→技巧 ·
0 0 405

Vibe Coding 初体验:WordPress 主题开发

我的博客主题原先就是参考Medium.com进行搭建的,但是参考的是上一版Medium.com的样式。Medium.com已经改版很久,本周抽了些时间,尝试使用Workbuddy重新制作一份。 初版样式: 最终效果: 开发工具:Workbu…

术→技巧 ·
0 0 204

长尾目标的 LightGBM 优化实践

背景:长尾分布的建模困境 什么是零膨胀长尾分布 在真实业务场景中,大量目标变量呈现零膨胀长尾分布(Zero-Inflated Long-Tail Distribution): 大量零值:目标变量中零值占比极高(如 40%~60%) 少量极端…

数据 ·
0 0 234

大语言模型中使用的搜索引擎

在使用AI工具时,比如Deepseek会有只能搜索的选项,在启用智能搜索后,AI对话的流程会话存在较大的差异。 Deepseek的联网搜索 联网搜索的差异 DeepSeek的“联网搜索”功能,其启用与否会直接改变它回答问题的整个流程。简单来…

器→工具 ·
0 0 320

国内外编程OJ网站整理

国内OJ平台 经典高校OJ POJ(北京大学在线评测系统) POJ由北京大学建立于2003年,是国内历史最悠久的在线评测系统之一。平台题目以英文为主,难度梯度设计科学,涵盖从基础到高阶的各类算法问题。POJ定期举办在线比赛,提供实战演练机会…

术→技巧 ·
0 0 480