restkhz's recent timeline updates
restkhz

restkhz

V2EX member #435565, joined on 2019-08-13 09:09:56 +08:00
Today's activity rank 18834
restkhz's recent replies
@zhouhuab 好啊,给你 tg 发了消息,认识一下。
@zhouhuab 还真是,只不过情况有点特殊...
@MIND222 谢谢

那就趁摸鱼多说两句吧。

这里有些年轻人有的不知道往哪里努力,有的根本没有所谓努力的底牌,有的人已经完全认输了。

我认识的几个专科的哥们,大多数农村户口,
有出息的自学了个 Spring,后来进了个外包。但是对于那些连 Spring 都不知道是什么的呢?

那些高中关在学校三年,家里也没人懂电脑,完全就是父母听说互联网好赚钱,就报了个 IT 专业。甚至可能就没碰过几次电脑。
人家学校教了个 Java,C,装个 VC++6.0 让你打个三角形,勉强教你学会了快排。你这能找到工作吗?你不能。
于是有些学校暑假和某些培训机构合作,收这群农村户口学生小几千,说是帮你们就业的培训,辅导员也拿着个花名册催着报名,我也不知道他们教了什么。反正你也不能说他们就多清闲。

然后?他们毕业了。

其实他们在毕业前后也经常问我应该学什么技术。
我其实和他们说过可以搞开发,前端后端,操作一下 git 学学 Vue 。但是我发现,他们似乎很认真的在和我讨论就业,城市,工资,又完全不懂 html,css 和 js ,甚至可能不知道他们能做什么。后端,听过 php,没听过 go,更别说 laravel, wordpress 。数据库?大概装过某软件园上下载的 MySQL.

最后问我
“xx 的网课好不好啊?看评论说他们比 xxx 好,B 站有 up 主推荐,课时怎么怎么样,比另一个贵一些...”
“那个谁的 CentOS 课有没有必要...”
“你说的那个文档什么例子怎么找?我搜了,没搜到。谷歌是吧?我这好像打不开?”

...

后面他们没再问过了。这么多年再也没联系过了。对其中几个人的记忆完全停留在他们朋友圈里发搞到个黄/蓝马甲,电瓶车,跑外卖去了。




到底我是想说,人投胎,不是靠努力投中的。中国人收入到底多少,我不知道,我不多妄加评论。
但是有的人似乎从出生开始手里就是一副烂牌,他们大多数人想过努力,也试过努力,但是他们的努力可能不会有什么回响。
甚至可能他们的努力本身就是一种会让他们慢性出血的陷阱。

而我不敢去批评或者指导这群人。因为我偷看过他们的牌,我知道换我,我也根本赢不了。
我很少在这种话题下说什么。

@LeoWA 我曾经简单研究过这个数据,你说的是对的。
“中国还有 6 亿人月收入低于 1000 块”这个说法不准确,不过,有时候更可能是一个家庭里三个人靠着一个人赚 3000 活着。
实际上如果研究最近这个数据的中位数,平均数,灵活就业,可能真还有 5k.

接下来我讲讲故事。

“只要稍微努力就能月入 5k”,而这个门在哪里?我见过一个乡镇中专妹跑到城市,压根不会用电脑,甚至电脑没摸过几次。而后在工厂呆腻了,想学点 excel ,在城市里谋生,可是连电脑也没有,没钱买。
她在网上的诚恳发问往往收获到的只有一片嘲笑。

我也有一些中专同学,他们出路在哪里?他们怎么样?我想来想去,换我,除了在床上刷抖音以外我也没办法。
前阵子有个失业一本女同学问我“搞 AI 行不行”,其实我是有点难以启齿的。是打算从 python 学起吗?然后搞 MNIST,从决策树随机森林再玩到神经网络?还是没有编程基础打算创业?靠着 Vibe coding 做点什么?可是她平时用的是豆包...翻 wall ?还在研究。


路在哪里?


只是觉得,我只是幸运罢了。


很难想这群人生存策略是在怎样一个环境里建立起来的。
我有个儿时玩伴,这小孩其实小时候很聪明,长大了一米八几,很帅。但是,他父亲坐牢,母亲跑了。剩下一个奶奶,他小时候这奶奶天天打麻将,见这小孩哭拽起来就打耳光,打到不哭为止。他羡慕其他小孩有零食有玩具,有一天他去超市偷零食,被抓了。多年以后据说他成了一个中专黄毛。

偷东西的坏小孩该不该被惩罚?当然应该。但是这种 spawn point 这真是他自己选的么?
我还见过外来务工人员的子女,小时候住我小区楼下地下室里,找个角落,床单挂着,一拉就是家。父母环卫工人。但这小孩小时候聪明绝顶啊!下棋爆杀我们,情商也很高,黑黝黝的皮肤,灵动的眼睛,长得也帅。然后呢?

然后我家买房,搬走了。离开了那个老旧小区,此后我和他们再也没见过。



多年以后,我出了国。
IT 专业,见到了很多印度人。其中我和一个印度哥们玩得很好。他一来这里就急忙找工作,一边上学一边搞什么 k8s 证书。
为什么呢?
后来,我知道他家有三个孩子,为了让他出国,父母借了一大笔贷款。利率 12%。他的家庭其实都很难承受住,这算是场豪赌。
他做的饭,其实是绿豆,米饭,西兰花,加上一些香料和少量的盐用高压锅煮的。他怯生生地问我吃不吃,生怕印度食物被鄙视。我和他去超市,天热,他连一瓶汽水都要思量再三。

实际上我吃着他做的饭,想到我和他说过,当年我骑着凤凰牌二手自行车去学 NOIP,遇到过那些家里开着保时捷送小孩,小学四年级就 C++手写 BFS,平衡树,后来打 OI 拿了什么奖的人,


心里总觉得怪怪的。
4 days ago
Replied to a topic by linora 生活 关于减肚子,大家有什么好的经验
@FaustinaD 能做到的是真厉害,狠人。
不算相关专业,个人认为不可能会无限扩大。下面的几个说辞也只是臆测,论坛灌水,不太经得起推敲。

1. 人类知识有限。绝大多数知识其实只是已有知识的更进一步。其中关系才是玄妙的地方。如果说可以归纳法得出的知识其实体积可能并没多大。至于某厂 API 调用方式其实完全可以利用互联网检索或者 RAG ,增长速度有限。
2. 贵在推理方式和经验,这几乎就是智能本身。然而这种东西占用多少空间?我不知道。但是应该不会是线性增长的。
3. Qwen3.6 27B 仅有 27B 的参数量,智能接近 Nemotron 3 Ultra 550B A55B ,MiMo-V2.5 这个 310B ,A15B.(根据 artificialanalysis )
4. Qwen3.6 27B 有如此智能不是没有代价的。它为了一个回答会进行大量的推理,以时间换空间。我曾经用过 Qwen3.5-9B 的模型,在某些,比如化学问题上一些刁钻的具体的化合物它完全没训练过,不知道是什么,但是只是根据一些规则就推理了出来。但是光推理就消耗了大量 tokens.令我惊讶的是,这个 9B 模型居然推理出了正确答案。者可以说明小 dense 或者 MoE 激活参数实际上增长不会快,未来多数场景完全够用。
5. 如果只是单纯说知识量,不如搞个搜索引擎,然后爬下/录入全人类的数据了。但是数据库没有智能。

我有一个暴论,在未来,随着算力和存储的提升,人们会在模型知识量和推理耗时,智能,以及他们的成本,用户场景体验中找到产品的平衡点。意味着实际上模型体积不会无限(至少不可能是线性)增大。未来大多数问题可能一个足够优秀的小模型+搜索/RAG 就能够解决。或者,可能会有缓慢增大(非线性增长)的 MoE+搜索/RAG,但是激活参数不会涨很快。

我认同 @ryd994 的观点。
鉴于最近的一些网络安全事件,大概可以理解。

其实从一开始就一直在讨论 AI 安全问题,当时他们还搞了个伦理与安全委员会,OpenAI 成立当初也是为了不能让这种技术掌握在少数人手里,只不过最后都变质了。

我也不觉得这种呼吁和限制中国模型发展有多大关系,毕竟算力已经卡的够死了。如果真是为了限制,还不如这三家联合搞点新闻跳个脚,让美国政府继续对中国施压。呼吁?真的有用吗?

Mythos 和最近 hf 的事情先不说真假,去年的 opus-4 已经能独立解出一个 VM opcode 混淆逆向的 CTF 题目。
我这本地跑一个 Qwen3.6-27B 它也晓得用 nmap,用 nuclei ,一路字典爆破顺便搞搞漏洞 exp.初级 CTF 逆向题和 pwn 它也完全能做到,能逆向分析恶意软件并且给函数重命名辅助逆向。我完全相信比它大百倍的模型有更恐怖的能力。

搞不好今年年底就有哪个中国公司开放权重一个百来 b 参数,能力接近 Mythos 的模型,还被人 abliterated ,直接武器化...
比如 GPT 早些时候经常说:
(最)能打
(不是)银弹,(而是)
实际落盘
Jun 24
Replied to a topic by lei2015 问与答 付费寻求关闭道德约束的 ai
Venice 。他们有 Gemma4 和 Qwen 的一些无审查模型,还有一个应该是 Dolphin 系列的。不记得了。有些是他们自己运行的模型,也有一些应该是提示词越狱的。

还有一个 nanogpt ,有 GLM-4.6 和 Qwen3.5 27B 去审查的,我有在用,但是他们家不是特别稳定。有时候感觉他们模型加载会失败。比如这会 GLM-4.6 无审查就 timeout 。有点玄学。

这两家都提供 API.

注意这些链接里我加了推广,你可以选择是否支持我一下(搓手)

https://venice.ai/chat?ref=B3nl-J
https://nano-gpt.com/r/xb6cpkrR
好巧不巧,我当时还真玩过那个盘古 Aplha ,当时叫鹏程盘古α。时间久远记忆模糊,我不评价。

但是我想说几个事实:
2019 的 GPT-2 可能不够大,但是已经能装模做样写东西了。Reddit 上还有人做 GPT-2 bot
GPT-3 是 2020 年的,最大 175B 的尺寸。
盘古 Alpha 是 2021 年的东西,最大 200B.
21 年同一年 Google 出了一个叫 LaMDA 的玩意儿,也是一百多 B 参数。当时还有个颇有争议的新闻。
22 年年底,GPT-3.5 发布。

嗯...?
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   1053 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 12ms · UTC 18:29 · PVG 02:29 · LAX 11:29 · JFK 14:29
♥ Do have faith in what you're doing.