智谱发了一篇关于他们为 GLM-5.3 开源发布做准备的文章,主要是关于他们开源模型的网络防御观点:
网络防御能力不应该掌握在少数资源雄厚的机构手中,开源维护者、独立开发者和小型团队同样需要这些工具。
这次 5.3 版本大幅强化了网络安全任务的能力。
显示更多
今天的骑行到位了,夏天晚上骑真是容易胖。
这个视频是用我下面的这个运动分析 Skills 做的,支持徒步、骑行和跑步。
如果你也想这样分享你的运动轨迹,可以装一个试试
显示更多
15 张数据图帮你了解 DeepSeek Harness
昨天 DeepSeek Harness 发布,于是就想着让 Codex 分析一下,找到了一个很好的角度,就是从一些数据上向大家介绍这个产品。
确实也发现了一些很有意思的东西:
插件系统与 Koishi 高度相似: 他们主打的插件系统与 Koishi 的插件平台相似度高达 75%。大概率是整个平台都挪过来了,不知道是不是他们的核心开发者入职了。
大量使用 AI 开发: Codex 命名的主干 PR 达到了 21.2%,分支信息中提到 Codex 的比例有 28.2%。 猜测他们肯定用了 Claude Code 开发,只是删掉了一些 Claude 的痕迹。
参考了大量外部 Agent 项目: 提到最多的外部项目是 Pi,第二多的是 Codex,之后是 Claude Code。甚至直接引用了一些 Pi 的 TypeScript 文件。
高效的代码产出: 整个产品在 GitHub 上有记录的是 65 天,总共的代码产出量是 84 万行,有一万多个 commit,非常高效。
交互入口的演变: 他们曾经押注 TUI,后来改成 Web UI 和 TUI 的双入口,再之后整个删除了所有的 TUI,只留下了 Web UI。
开发与工程规范: 整个项目的测试代码比生产代码多很多,基本上达到了 1:1。 全仓库的 Markdown 文档也非常多,说明他们是基于文档去控制 Harness 开发的。他们有完整的工具和科学模型 schema 共 52 个,但最后只留下了一个,目的是为了减少上下文占用。
社区热度与生态:从昨天发布到现在 20 小时,GitHub 已经涨到了 8 万多的 star,非常快。插件体系标签(DSH plugin)已经有 1425 个项目,但有很多并不是真正的插件,看来有不少蹭热度的。 精选清单收录了 211 个仓库,主要补充的是工具、UI 和运行的一些基础设施,甚至一上来就出现了插件市场和插件管理的插件。
学术论文: 他们顺便发了一篇 88 页的论文,其中 57% 都在做一些形式化的理论推导和展示。论文主要讨论的是插件的热插拔和系统稳定性问题。
显示更多
GLM-5.3 发布了,看了一下,着重提升的主要是两部分:
1. 安全能力:看来 Hugging Face 在拿 GLM-5.2 防御了 OpenAI 的模型入侵以后,智谱也看到了这方面的价值,尤其是大家最近都在聊这块,他们针对性地做了一些优化。
2. 长程任务的执行:
比如终端里的任务、工具调用,以及大代码库的修复任务,都有非常大的提升。
这个模型依然是只进行了后训练,没有重新进行预训练。这都几个版本了,还能有这么大的提升,确实猛啊!
显示更多
Introducing GLM-5.3: Built to Code. Ready for Cyber Defense.
- Top-tier coding and agentic capabilities, achieved through post-training on the 743B base model
- A major leap in cybersecurity, setting a new standard among open models
Tech Blog:
显示更多
Twitter 完全开源了他们的推荐算法
用 Codex 分析了一下,感觉跟以前我们的认知还是有不少变化的。
总结了六条创作者应该做的事情:
1. 应该做值得转发的原创内容。
2. 尽量少用首贴写钩子,把重要内容放在第二条推串里这种发帖形式(这个和大家的认知不太一样,比较重要)。
3. 应该优先争取阅读、回复、引用和关注,点赞的权重其实没有那么高。
4. 拉开发帖间隔,不要频繁刷屏。
5. 深耕一个垂类,不要频繁更换账号类型。
6. 少做那些互动诱饵(比如互关、回复发送等),不要让别人讨厌你、对你点“不感兴趣”或举报。
显示更多
Twitter 完全开源了他们的推荐算法
用 Codex 分析了一下,感觉跟以前我们的认知还是有不少变化的。
总结了六条创作者应该做的事情:
1. 应该做值得转发的原创内容。
2. 尽量少用首贴写钩子,而是把重要内容放在第二条推串里(这个和大家的认知不太一样,比较重要)。
3. 应该优先争取阅读、回复、引用和关注,点赞的权重其实没有那么高。
4. 拉开发帖间隔,不要频繁刷屏。
5. 深耕一个垂类,不要频繁更换账号类型。
6. 少做那些互动诱饵(比如互关、回复发送等),不要让别人讨厌你、对你点“不感兴趣”或举报。
显示更多
别的不说,Deepseek harness 这个 star 的涨势是真猛,一个多小时都快两万 star 了
Deepseek Harness 0.1 版本正式发布了,而且开源!
看起来主打的是他们那套插件系统,有点复杂。
Deepseek Harness 0.1 版本正式发布了,而且开源!
看起来主打的是他们那套插件系统,有点复杂。
可能会有单独的套餐吧,要不就是 API 涨价推他们的 Harness?
Deepseek Harness 内测群说晚上 8:25 左右发布。
V4 Pro 0813 的正式更新公告来了,同时涨价额度也确定了。
看来下午的 V4 Pro 0813 模型是有点不对,现在他们正式发了更新公告,这次估计是没啥问题了。
同时涨价也尘埃落定了,采用峰谷定价,峰值定价 Pro 模型输出比原来贵了 4 倍多。
空闲时段的 Pro 模型定价比原来贵了一倍多。
显示更多
卧槽,V4 Pro 08313 正式版涨价,那个峰值最高比原来涨了 4 倍多,这回真成梁子了。
V4 Pro 0813 的正式更新公告来了,同时涨价额度也确定了。
看来下午的 V4 Pro 0813 模型是有点不对,现在他们正式发了更新公告,这次估计是没啥问题了。
同时涨价也尘埃落定了,采用峰谷定价,峰值定价 Pro 模型输出比原来贵了 4 倍多。
空闲时段的 Pro 模型定价比原来贵了一倍多。
显示更多
V4 Pro 0813 的正式更新公告来了,同时涨价额度也确定了。
看来下午的 V4 Pro 0813 模型是有点不对,现在他们正式发了更新公告,这次估计是没啥问题了。
同时涨价也尘埃落定了,采用峰谷定价,峰值定价 Pro 模型输出比原来贵了 4 倍多。
空闲时段的 Pro 模型定价比原来贵了一倍多。
显示更多
分数来源:
reminder that deepseek made NO announcement for the new V4 Pro anywhere on social media because they are ashamed of it
>scores only 1 point higher than V4 Flash
DeepSeek V4 Pro 的 0831 版本不太对劲,他们是不是又把模型给撤了?
现在的情况非常奇怪:
API 确实是有的,在 API 的模型和价格这部分写的是 0813,但是更新日志页面完全没有提到 0813 的更新。
官网上面原本关于“DeepSeek V4 Pro 更新正式版”的横幅也被撤掉了。
模型的文档里写的是 0813,更新日志里却没有。
因为我们没办法直接知道他们到底更没更新,只能通过官方公告来确认,但他们现在既没有发正式的公众号文章,也没有发布任何公告。
Artificial Analysis 测出来的得分也很怪,V4 Pro 正式版只比 V4 Flash 高了一分,两者的得分几乎是一样的。
他们现在什么也不说,测出来的得分又不对。这不让昨天熬夜测试的人都成小丑了吗?我去
显示更多
又重置了 朋友们
Old news actually from a bunch of days ago, but crossed that 15M. Enjoy a nice reset everyone. Landing in the next hour or so, go /fast.
流传的截图,说是 DeepSeek Harness 会在今天公测,不是要跟 0813 的模型细节一起发布吧
DeepSeek V4 Pro 正式版 0813 发布了!
从流传的测试成绩来看依然相当爆炸
DeepSeek V4 Pro 正式版 0813 发布了!
从流传的测试成绩来看依然相当爆炸