观点

生成式AI的信息熵问题

生成式AI的信息熵问题 信息论里,信息熵衡量的是不确定性的消除程度。一个事件发生的概率越高,它携带的信息量就越少。当前的大语言模型,工作逻辑恰是:在给定上文后,预测下一个最“合理”、出现概率最高的词元。这个机制,天然倾向于选择数据分布中“最…

观点 ·
0 0 54

产品经理的数据法门:求之身内

在数据驱动的时代,产品经理们常常陷入一种“数据焦虑”:我们追逐着层出不穷的BI工具,渴望着更实时的数据看板,迷信着A/B测试的绝对真理。我们向外寻求,希望找到那个一击即中的“银弹”指标,仿佛数据之神藏身于海量的报表之外,等待我们去发现。 然…

观点 ·
2 0 210

《软件随想录》读书笔记

[LATEXPAGE] 《软件随想录》简介 《软件随想录》(Joel on Software)是乔尔·斯波尔斯基(Joel Spolsky)的经典文集,汇集了他对软件开发、团队管理、技术选型等领域的深刻思考。这本书的价值不仅在于其内容本身,…

志→目标 ·
3 0 570

拒绝计划性报废与硬件绑定

什么是计划性报废? 计划性报废是指制造商有意设计产品,使其在一定时间后失效或过时,以促使消费者更换新产品。 计划报废的种类: 系统性计划报废:故意更改系统设计,让产品难以继续使用。例如软件刻意不向下兼容,或是经常更换螺丝规格、刻意让既有工具…

观点 ·
4 1 1

《乔布斯的100条思考》的思考

《砺石商业评论》在乔布斯离世13周年的时候梳理了乔布斯的100条思考,涵盖了他在创新、创业、产品计、管理与人生经验等各个领域的洞见。 关于创新洞见 001.宝丽来创始人埃德温·兰德说过一句话,“能站在人文与科技的交会处,取两者之长的人,才是…

志→目标 ·
2 0 1

技术选型:选择无聊的技术

新技术总是让工程师兴奋不已。新的编程范式、新的编程语言、不同的库、不同的数据库。我们总是在寻找新奇并渴望学习,但用户并不关心你的公司使用什么技术。只要你的产品有效,他们就会很高兴。 《Choose Boring Technology》这篇文…

术→技巧 ·
1 0 600

LightGBM的模型保存

平时在使用LightGMB,需要保存训练好的模型。以下是梳理的几种方式: 使用LightGBM 自带的save_model 方法 import lightgbm as lgb # 假设已经训练好的模型是 model model = lgb.…

数据 ·
4 0 1

活在卓别林的摩登时代

写给除夕还在上班的各位打工人! 《摩登时代》中的世界 故事的主人公是卓别林标志性的角色“小流浪汉”(The Tramp),他在一家工厂里工作,处于流水线的高压环境下。在试图跟上机器的节奏时,他遭受了精神崩溃,并因此被送进了医院。 剧中的老板…

观点 ·
1 0 917

数据的“有我之境”与“无我之境”

王国维的境界 王国维在《人间词话》中把艺术境界分为“有我之境”与“无我之境”两种: 有我之境: 泪眼问花花不语,乱红飞过千秋去。 可堪孤馆闭春寒,杜鹃声里斜阳暮。 无我之境: 采菊东篱下,悠然见南山。 寒波淡淡起,白鸟悠悠下。 有我之境,以…

观点 ·
11 0 1

《人工不智能》读书笔记

周末的时候花了半天的时间把这本书快速的看完,当初要买这本书的时候是被这个书名吸引。毕竟先前看了那么多“人工智能”相关的数据。也有需要从另外一个角度去思考思考问题。 这本书的中体感觉是信息密度太低,原本可能一篇博客就能讲清楚的问题,硬是写了一…

志→目标 ·
12 0 1