WhatIf's recent timeline updates
多线作战
一个云报销平台
一个商城规则管理
一个爬虫
一个语义识别
还有一个内容发布平台
Dec 3, 2015
努力打造一个小的代码框架中,心中却在挂念着巫师
Sep 13, 2015
WhatIf

WhatIf

V2EX member #76663, joined on 2014-10-10 23:44:25 +08:00
有出 NS 的马里奥派对游戏的吗? 坐标魔都
二手交易  •  WhatIf  •  Jan 10, 2020  •  Lastly replied by WhatIf
4
有出文石 max2 的吗?
二手交易  •  WhatIf  •  Apr 17, 2019  •  Lastly replied by WhatIf
2
请教,设置 WDS,一段时间后自动掉线问题
宽带症候群  •  WhatIf  •  Jul 24, 2018  •  Lastly replied by yingfengi
3
魔都出几个 PS4 中文游戏
二手交易  •  WhatIf  •  Mar 25, 2018  •  Lastly replied by WhatIf
3
有没有成熟的语音导航设备或软件?
汽车  •  WhatIf  •  Feb 26, 2018  •  Lastly replied by skylancer
29
有啥靠谱的.com.hk 的域名注册商吗?
问与答  •  WhatIf  •  Apr 18, 2017  •  Lastly replied by Williamp
5
ubuntu 16.04 耗电太大
  •  2   
    Ubuntu  •  WhatIf  •  Jun 15, 2016  •  Lastly replied by WhatIf
    39
    WhatIf's recent replies
    3 days ago
    Replied to a topic by lhc70000 › 分享创造 › IINA 1.5.0 发布了
    看到帖子,就通过菜单操作了检查更新, 但是没有开全局的梯子,更新失败.
    当初因为 mac 上 vlc 性能太差转向了 iina , 用到了现在
    生成失败,已退回本次消耗的积分(或免费次数),请重试。
    第一次操作, 无法执行
    今年高价位入手了一台 160w 的 ai max+ 395 机器 128G 版本 , 早先就是玩具,qwen3.6 35BA3B Q4KM 加上 mtp 可以到 70token/s 的 decode 速度, prefill 差不多 300-600 之间。
    后面 qwen3.8 27b 出来, 默认 17token/s 加上 mtp 24token/s 如果选择 UD Q8 量化 差不多 15-17 的样子,xhigh 思考模式下 ,跑一个鹈鹕 1 小时起步。 但是效果方面还是 Q8 能真干活。
    最近发现一个 halogen 的框架, 运行 qwen3.8 flash next 125B 4 位量化 ,能有 50-70token/s 的速度,prefill 1500 左右, 接入 opencode 或者 deepseek harness 完全够用。
    今天也折腾了一下 minimax h3 , 生成差不多 640*480 这一档的视频,5s 长度 要 4 分钟左右,8s 时长的 8 分钟起步。

    感觉现在已经是脱离了玩具的范畴,真能用了, 但是缺点也有, 风扇呼呼得很吵。

    我另外一个方案是垃圾佬模式, 2080ti 22G*2 跑 qwen3.8 27B fp8 prefill 初始状态下 1300 左右后面会跌落到 700-900 吧 ,decode 60-160 之间, 当然得用合适的推理框架,配合 dflashv2 的结果。
    strata 跑 qwen3.8 flash next , 我用 Swift-1.5-Qwen3.8-Flash-Next-GSQ-RCO-GGUF IQ3_XXS 的情况下,decode 速度比 ai max 的机器略高 50-90 之间吧,harness 里面统计的一般是 75-80.
    这个方案我都是限制显卡在 180w 的场景, 这样温度最高 72 左右, 风扇声音不会起飞(当然我把侧盖打开也有关系)

    价格方面 ai max 395 无固态的版本 当时是 17949 现在看好像还是没变, 2080ti 22g 当前 3000 出头一张卡
    May 10
    Replied to a topic by davidyin › Local LLM › 想折腾一个 AI 主机,请行家出手
    24G 的 3090 ,4090 之类 可以跑 30B 上下规模的模型,但是上下文很小, 项目大了估计就不行。
    但是感觉 32G 48G 的也好不了太多。
    那么只有 pro 6000 96G 显存 能全量跑 32B ,这两天狗东刚看了下价格, 有提供整机的,84000 左右
    爬过一次径山, 寺庙里还喝过一小口
    Mar 22
    Replied to a topic by hzdt › 生活 › gemini 给我推荐的补剂方案合理吗?
    作息时间是否正常? 血压是否正常?
    Mar 17
    Replied to a topic by MrTlyer › 分享发现 › 说说曾经买过的软件
    steam, playstation store, wps, wiznote
    扫码进群,抢红包,抽小龙虾 AI 主机!实现 OpenClaw 龙虾自由!
    @cheese 话说我昨天让 AI 写了一个安卓 app 的前端+接口后端,用来实现支付宝支付的完整流程。包括下单,回调,支付取消,回调未收到的轮询复查等功能。代码的确是一遍就能用的,当然功能一开始不能正常工作,扔给 AI 信息以后,指出商户后台没配置,配置完全功能都正常可用。唯一的问题是取消订单接口实现时,并未判断订单是否归属当前用户,但是我相信这种问题大量的人都会犯,所以指出一下立马补全了。
    当然如果啥都不懂的人是不是可以搞定就不好说了。
    好像还没开始抽? 那么无耻地+1
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   3322 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 24ms · UTC 11:58 · PVG 19:58 · LAX 04:58 · JFK 07:58
    ♥ Do have faith in what you're doing.