sentinelK's recent timeline updates
@kop1989 @kop1989smurf
三转
May 31, 2023
我本将心向明月,奈何明月照沟渠。
May 30, 2023
sentinelK
ONLINE

sentinelK

V2EX member #631792, joined on 2023-05-30 20:41:02 +08:00
Today's activity rank 1212
kop1989的三转小号
deepseek-flash 的第三方跑分趣闻
DeepSeek  •  sentinelK  •  6 days ago  •  Lastly replied by sentinelK
3
sentinelK's recent replies
1h 11m ago
Replied to a topic by tobacco Android 豆包手机发布了,好像没啥讨论的
工具的核心就是得省精力。

目前所有的 Agent 其实本质上都是一件事上的注意力和精度之间的取舍。
你越选择少分担注意力(越多的交给 Agent 定夺),结果精度就越差。

然而现实生活中其实很少有那种需要占用巨大注意力,且可以接受低精度结果的场景。(毕竟你不可能把你所有的数据都交出来)

另外就是要求第三方自愿同意交出 app 的注意力权力给模型,其实是反人性反利益的。
不光是坟帖的问题,v 站有个权重算法,自己回帖、相同账号重复回帖基本不占权重。

看的人越多、越多不同的人回帖,越靠前。
@yh7gdiaYW 可能是跟 claude code 接入 GPT 模型需要代理有关,代理还是有信息损失和额外干扰。

不过这个结果确实有点娱乐效果。太逗了。
@longaiwp 千问系列就明确官方跑分都是 claude code 环境,反正模型结构注定放弃响应速度了,不如提高跑分上限。
@Jerry02 是,所以我认为“租金”这个成本定义不贴切。
@niubilewodev 好奇的就是这个常数,5.71$/秒,其实是可以根据商电(暂定 1 人民币/千瓦时)、卡租金( 5090 4 美金/小时)反推的。大概是等效 5000 张 5090 ,感觉少了点……
决定最终产出倾向和格式的是后训练以及微调。
所以其实理论上讲,只要是开放权重的模型,有硬件,任何人都可以做到楼主说的效果。

但是工程学要讲究性价比。作为一个闭源模型,作恶没必要搞这么复杂。
gpt6 的和 gemini 给的分辨率都不同(看围裙的色块层次就可以)。结合你上面实际截图的可视距离,有没有可能 gemini 给你的方案你根本就看不全?
轻度使用可以。但是实际工作中千万不能这么用,AI 会自作聪明,搞混。

比如两个非常相似的日程,AI 的记忆会串台。
3 days ago
Replied to a topic by Haku 程序员 自部署模型卖 Token 能赚钱吗?
@Haku 简单说就是,对于大模型,使用人数和成本的关系是指数的。

每多加一个人,成本都翻一个次方。直到到一个规模化平台。
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   5029 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 18ms · UTC 05:44 · PVG 13:44 · LAX 22:44 · JFK 01:44
♥ Do have faith in what you're doing.