ch
Feedback
咸咸湿湿

咸咸湿湿

前往频道在 Telegram

最💗新💗最💗热💗咸💗鱼💗资💗讯

显示更多
未指定国家未指定类别
248
订阅者
-124 小时
+17 天
+1030 天
帖子数量

数据加载中...

反应
评论
Telegram 星星
按以下排序的热门帖子

数据加载中...

发布分析
帖子
浏览量动态
我本地跑的 Honcho 记忆里面提到: When you're wrong, say "改悔" and fix it — don't ramble, don't whine, don't joke about quitting. 笑死,看起来是我说太多次 ✝️你改悔罢✝️ 给人工智障搞出 PTSD 了
41000Loading...
有点想写一个专门为 GB10 和特定模型架构优化的推理运行时,但是古咕固
46000Loading...
GB10 输麻了
46000Loading...
FreeToken开源:一张5090跑DeepSeek-V4-Flash,最高25 Token/s 伯克利、MIT 等研究者开源 FreeToken。这是一个专门为本地设备设计的 MoE(混合专家模型)推理引擎,主要解决超大模型显存装不下的问题。它会把部分权重放在系统内存,并让 CPU 和 GPU 一起参与推理。 FreeToken 会把模型的大量专家权重放在系统内存,只把一部分缓存在显存。遇到显存里没有的专家时,它会根据 PCIe 和 CPU 内存带宽,动态决定是把权重搬到 GPU,还是直接交给 CPU 计算。这样 CPU、GPU、系统内存和 PCIe 可以一起参与推理。 论文实测,一台配备 RTX 5090 的游戏台式机运行 284B 参数的 DeepSeek-V4-Flash,可以达到 22–25 Token/s。这款模型每生成一个 Token 实际只激活约 13B 参数,因此特别适合这种 CPU、GPU 混合推理。 FreeToken 还在 8GB 显存的 RTX 4060 笔记本上把 35B 模型跑到 39.3 Token/s;单张 96GB RTX PRO 6000 则可以运行 753B 参数的 GLM-5.2,速度达到 llama.cpp 的约两倍。项目目前支持超过 20 款 MoE 模型,并已采用 Apache 2.0 许可证开源。 信源 动察 Beating 频道 · 动察 Beating 交流群
26300Loading...
https://youtu.be/tfrurU-zbfY 太好了,他还活着
52000Loading...
https://github.com/pollen-robotics/microduck 可爱捏
54000Loading...
咦 GTA VI 怎么首发还是 PS5 + Xbox 独占?
48000Loading...
https://www.dingusland.fun/ xs Wade 这什么神金网站
48100Loading...
诶草,它的 ANC 是 BOSE 做的,这下真想要了 送我!
47000Loading...
https://youtu.be/7rpJF9mEhz0 这还能有新款,送我!
48000Loading...
https://youtube.com/shorts/CGHI5bCLhqQ
51000Loading...
HeHeDa: jandan.net/t/6201791 OO: 74 XX: 23 旋转跳跃闭着眼: rgb主机呢? OO: 15, XX: 0 观竹吃笋: 没有马桶 OO: 9, XX: 0
HeHeDa: jandan.net/t/6201791 OO: 74 XX: 23 旋转跳跃闭着眼: rgb主机呢? OO: 15, XX: 0 观竹吃笋: 没有马桶 OO: 9, XX: 0
45000Loading...
杯面骑士: jandan.net/t/6202050 OO: 86 XX: 4 蛋友24ca83bdd9dc: 蛋友e6202772cd4a0 这明显是吃火锅吧 OO: 12, XX: 1
杯面骑士: jandan.net/t/6202050 OO: 86 XX: 4 蛋友24ca83bdd9dc: 蛋友e6202772cd4a0 这明显是吃火锅吧 OO: 12, XX: 1
45000Loading...
HeHeDa: jandan.net/t/6201968 OO: 84 XX: 3 KLKL: 也是《生存挑战》,要在这里坚持1个小时。 OO: 20, XX: 0
HeHeDa: jandan.net/t/6201968 OO: 84 XX: 3 KLKL: 也是《生存挑战》,要在这里坚持1个小时。 OO: 20, XX: 0
47100Loading...
https://youtube.com/shorts/QpTma0F_dIc 草
50000Loading...
让 Gemini 3.7 Flash 概括 YouTube 视频,然后它就疯了 没想到 6202 年还有 hosted 模型能出这种问题
让 Gemini 3.7 Flash 概括 YouTube 视频,然后它就疯了 没想到 6202 年还有 hosted 模型能出这种问题
59000Loading...
https://youtu.be/mu-EcTZaeIk 草
66000Loading...
看了 Obsession,我宣布这是 2026 年最佳禁毒神片!
96101Loading...
没有文字...
59000Loading...
等等华为那个阔直板也就 16:9.5,那是不是可以说手机屏幕比例兜兜转转又回到了接近 16:9(x 然后折叠屏到了 16:10 或者 3:2(x
70000Loading...