catazshadow

catazshadow

V2EX 第 399613 号会员,加入于 2019-04-08 17:11:05 +08:00
catazshadow
分享发现  •  catazshadow
AI 回旋标来了
6 月 12 日  •  最后回复来自 woshishui2022
12
Local LLM  •  catazshadow
为什么你该停止使用 Ollama
4 月 19 日  •  最后回复来自 seakingii
14
水  •  catazshadow
疑似被 ban,求解封
2 月 28 日  •  最后回复来自 catazshadow
2
水  •  catazshadow
跪求个邀请码
2025 年 9 月 11 日  •  最后回复来自 pcy
2
水深火热  •  catazshadow
"自研"其实是一个极其模糊的概念
2025 年 5 月 25 日  •  最后回复来自 lyatqh
18
水深火热  •  catazshadow
性同意网站/app 是区块链的落地场景才对
2025 年 5 月 22 日  •  最后回复来自 Livid
35
catazshadow 最近回复了
回复了 apollo007 创建的主题 › 关于教育,我有一个比较武断的观点16 小时 34 分钟前
这是社会评价的单调体系和个体的真实长处的错位

应试教育注重公平,所以只能在所有人的能力里找最大公约数来设计考题。但个体能力在这之外还有很多,这些能力在应试的选拔方式下无法考察。

所以进师范的学生只能说他们不太适合应试。但是同时应试成绩无法说明他们适合教书。

也就是说,理想的选拔需要挑出:教育天赋=true 的学生,让他们进师范

应试结果只能说明有的可能具有教育天赋的学生(教育天赋=true || 教育天赋!=true )不适合应试,完全筛不掉后者。
回复了 Donahue 创建的主题 › 实体倒闭真是活该的1 天前
维持商誉的好处是对做长久生意更有利,但是现在这些做生意的主打一锤子买卖打一枪换一个地方,骗人根本没有代价。

真正的代价是让骗子付出一辈子的名誉,这就需要曝光,曝光就要信息自由流动,信息透明度和信息真实性。而这些每一样都是老爷们压制的,为啥?万一老爷自己被曝光了还是次次实锤,那怎么可以。

最后的结果就是能肆无忌惮骗人的互相勾结骗剩下的所有人,哪些人能肆无忌惮骗人?大官和大商人,官商勾结,裙带关系就这么来了

你们抱怨的,全都是自己选的
回复了 liu0825 创建的主题 › 阿里这次比不上腾子!这个智能终端确实更懂运维3 天前
阿里巴巴那种管理方式,注定做什么都是烂尾
回复了 zzutmebwd 创建的主题 › pro6000 部署 Qwen 3.8 flash next nvfp43 天前
@coefu 上下文压小了确实会快点,回头看看怎么搞
回复了 zzutmebwd 创建的主题 › pro6000 部署 Qwen 3.8 flash next nvfp44 天前
@coefu 还能这么玩。要配合 flash next 还是都可以?压缩了会变傻么?
回复了 zzutmebwd 创建的主题 › pro6000 部署 Qwen 3.8 flash next nvfp44 天前
@coefu qwen 3.8 flash next ,就你上一条发的那个

电费算毛 hhh 。还有就是 layer split 其实每一时刻只有一张卡满载,总功率其实是(N - 1) 待机功率 + 1 x 满载功率,6 张卡也就 400W 来瓦顶天了,几千块搞定 Strix Halo 能干的活,要什么自行车🤣
回复了 zzutmebwd 创建的主题 › pro6000 部署 Qwen 3.8 flash next nvfp44 天前
@coefu 加上万兆网卡的结果,一共 96G 显存,两台机器 4+2 张卡

qwen 系列的 prefill 感觉跟这种跑法有仇,开头就只有 160 多,直接放弃了。单机用 lazy 模式跑也不快,简直了。

laguna S 和 mistral small 都差不多,加载了个 110K 的会话历史,开始 prefill 在 480 左右,在 110K 的时候大概有 280 ,tg 的话能有 10 左右,感觉是垃圾佬的极限了,毕竟几千块跑起来这么大的模型。
写内核的依旧古法
© 2026 V2EX · 23ms · 3.9.8.5