注册并分享邀请链接,可获得视频播放与邀请奖励。

lifcc (@mylifcc) “DeepSeek 这出戏,挺离谱的。 8月12日深夜,V4 Pro 正式版几乎没声没响就上了。API 文” — TopicDigg

lifcc 的个人资料封面
lifcc 的头像
lifcc
@mylifcc
加入 January 2022
0 正在关注    0 粉丝
DeepSeek 这出戏,挺离谱的。 8月12日深夜,V4 Pro 正式版几乎没声没响就上了。API 文档把版本号改成 DeepSeek-V4-Pro-0813,官网首页也挂了句提示,官方群里还甩出一组很高的 Agent 分数,Terminal Bench 2.1 到了 87.9,DeepSWE 直接拉到 62.7。看着像是从 Preview 正式转正了。 结果当晚到第二天凌晨,社区实测一片骂声。最明显的问题是思维链。复杂任务本来该好好想一阵子,结果很多场景思考时间压到 10 秒以内,有的甚至直接开写。长程 Agent 任务还容易早停。同一条直升机 3D 游戏任务,凌晨 0 点左右做出来很糙,过了不到 4 小时再测,已经能完整跑出像样结果。差距大到像换了个模型。 很多人怀疑不是权重本身废了,而是集群部署、推理配置或者服务端 Harness 出了问题,正式版当时根本没跑满。 北京时间今天凌晨 3 点左右,疑似紧急回滚了一波。之后表现明显好转。官网首页的发布公告和开放平台公告也跟着撤了,只剩 API 文档里版本号还在。 到今天下午,官方才正式发推宣布 V4 Pro 上线,APP、网页、API 同步更新,并放出完整更新说明。思考强度支持 low / high / max 三档,原生支持 Responses API,还专门适配了 Codex。价格也要调,8 月 17 日起实行峰谷定价。 现在 0813 已经重新挂出来,权重也上了 Hugging Face。但昨晚那一晚的翻车,确实让人觉得发布节奏和线上稳定性之间,还有不小的缝。难道是用ai发的?
显示更多
0
15
28
2
转发到社区