注册并分享邀请链接,可获得视频播放与邀请奖励。

Gorden Sun 的个人资料封面
Gorden Sun 的头像

Gorden Sun (@Gorden_Sun)

@Gorden_Sun
0 正在关注    0 粉丝
OpenAI开发者日活动日程,中英双语版 游戏、网站、云端Codex、多人协作,这几个是我感兴趣的主题。
如何解决 AI 写文章的 AI 味儿? 现在的 AI 写数学题或写代码很厉害,但在写学术论文、小说或百科文章时,经常产出空话连篇、表面流畅但缺乏真正深度的文字,这种低质文本常被称为“AI 废话”(AI slop)。 出现这个问题的原因在于,常用的 AI 评分系统很难辨别真正优秀的文字。研究人员发现,如果让目前的先进模型给文章打分,或者让它们自由制定打分标准,模型给出的分数往往偏向 AI 生成的内容,甚至给 AI 文本的分数远高于人类专家的原著。打分裁判本身偏好废话,训练出来的写作模型自然就会写出更多废话。 为了解决这个弊端,META 提出了一套名为 RL-XAR 的新训练方案,核心思路分为三步: 1)准备参照标杆:收集高水平的人类写作范例,比如真实的科研论文、名家小说和维基百科精选词条,截取前半部分作为上下文,分别让人类专家和 AI 模型顺着往下写。 2)训练评分规则:让 AI 裁判反复调整打分标准,直到这些标准能准确把人类高手的文本评为高分,把 AI 生成的文本评为低分,真正拉开两者的差距。 3)针对性强化训练:用这套校准后的高难度评分规则去重新训练写作模型,不断循环这个过程,逼迫模型改掉毛病。 META 在三个领域测试了这种方法: · 学术论文写作:模型需要补写论文中被拿掉的摘要、引言或结论。经过新方法训练的模型,不再像以前那样把整篇论文翻来覆去复述一遍,而是学会了精简和突出重点。原作者进行盲测评估时,新模型的胜率达到了 89%。 · 文学小说续写:续写普利策奖和诺贝尔奖得主的作品。模型改掉了乱用陈词滥调的比喻这一常见毛病,盲测胜率达到了 95%。 · 维基百科编写:根据标题直接写出正文内容。这项任务难度最高,模型虽然也有进步,但因为现有的 AI 裁判能力有限,提升幅度不如前两项明显。 所以,想让 AI 写出更像人类高手的深刻文字,关键在于先训练出眼光挑剔的评分标准,避免让模型用平庸的标准自我满足。 原文:
显示更多
ESPnet发布YODAS v3语音数据集:大幅降低多语言语音AI的训练门槛 这个大规模开源数据集包含超过110万小时的多语言网络音频,覆盖了100多种语言。不仅提供句子和单词级别的时间戳字幕,还为大部分非英语内容配备了英文翻译,甚至标注了实际有效的音频采样率与声道信息。对于想要训练语音识别、语音合成或音频表征模型的研究者来说,可以直接获取规整、无版权问题、高质量、多语言的基准数据。 数据集:
显示更多
外卖抢单大厅上线啦!程序员变外卖员啦!
说一下A\现在的工程师工作流程: 所有MTS的claude session共享。 所有的项目共享。每个人可以搜到其他人的session history. 每个人可以抢占其他人的tasks去做,谁做出来credit是谁的。 平均一个人有7-10个tasks在queue里,做的快的飞快。 做的慢的,queue里的7个task一眨眼就被人家抢走6个,自己那个还没做完。
显示更多
看洋洋洒洒写这么多,我就知道是要砍订阅额度了。 不用看写的各种解释,都是哄人的,总之一句话就是20×订阅即将回归,但是额度大砍。
Hi, Tomorrow we are re-opening the Pro $200 subscriptions to new subscribers, but together with it we are also changing how we calculate the usage for it. In effect, if you do the math, it will net out at half the dollar in API spend compared to the old Pro $200 plan. Now that it's said, let me explain why this is happening and why you will still get more work done than if you were on the Pro $200 subscription one month ago. (a) We didn't want to compromise in other ways and are committing to not reintroducing the 5h limit, so that you can fully use the weekly usage when you want. (b) On the subscription, we guarantee that over time you always get more work done and with an increasing level of quality. This means that you will continue to get more value per dollar spent as a result of models getting more efficient and us passing down the improvements in the form of API price reductions. (c) We don't want to put an incentive on ourselves to artificially inflate the API list prices to make it look like you are getting a lot (and workaround it through discounts, etc). Instead we want to continue to both rapidly reduce prices and increase capabilities of models on the API. This week we introduced GPT-6 Sol and GPT-6 Luna at 50% of their previous price. Over time, we see prices go low enough that it makes sense for most to buy usage as needed without there being a significant gap between what you get in a subscription and what you get in the API for a dollar spent. (d) Tomorrow, we are adding more things to the subscription that won't draw on the usage, I won't reveal what that is yet. I wanted to be transparent before all the big announcements tomorrow. Lots of new exciting things are coming to the subscriptions that will make it super compelling, but I wanted to make sure to share this change ahead of time so you can all understand it before we shower you with good news. Codexingly, Tibo
显示更多
才发现我竟然有Manus创始人肖弘的微信,备注还是微伴助手CEO,好像是AI时代前某次企业微信的大会添加的。 Mamus起起伏伏太牛逼了,恭喜Manus
显示更多
Introducing Manus 2.0
AMD收购李飞飞创办的World Labs,价格82亿美元,这也太快了吧?
Sonnet 5.5发布了,这个模型有多强呢?Anthropic首次给Sonnet模型加上了安全路由和防蒸馏机制。
Introducing Claude Sonnet 5.5, the second model in the Claude 5.5 family. It’s a clear upgrade over Sonnet 5, runs more than 30% faster, and costs up to 30% less for most work.
显示更多
Opus做的中国上下5000年视频,TTS是调用的我本地的模型生成的,TTS拉垮了。后续还是配上Gemini 3.8 TTS,送的API额度不用白不用。
Opus做的中国上下5000年视频,TTS是调用的我本地的模型生成的,TTS拉垮了。后续还是配上Gemini 3.8 TTS,送的API额度不用白不用。
ElevenLabs发布Eleven v4与v4 Turbo:让AI配音具备真人演员级情绪控制与实时对话能力 采用全新架构,支持在文本中直接加入笑声、耳语等导演标记与环境音效,并保持长音频音色稳定。同步推出的Turbo版本将首字语音延迟降至约150毫秒,专为实时语音交互设计。 官方介绍:
显示更多
Introducing Eleven v4 and Eleven v4 Turbo, our fastest and most emotive voice models yet. Ranked #1# by Artificial Analysis.
11Labs发布Eleven v4 和 Eleven v4 Turbo 更快、更具情感,大概是为了应对Gemini 3.8 TTS,Gemini 3.8 TTS的效果也非常好,而且AI Studio里可以免费用
Introducing Eleven v4 and Eleven v4 Turbo, our fastest and most emotive voice models yet. Ranked #1# by Artificial Analysis.
Meta 宣布推出名为“Meta Enterprise Platform”的企业服务平台,正式把服务企业客户作为公司未来的核心业务支柱之一。 Meta 打算把自家的底层技术开放给各类公司和开发者使用。初期开放的技术包括智能助手 Muse、商业助手 Meta Business Agent、编程工具 Muse Code 以及相关的软件开发接口,方便企业把 Meta 的 AI 能力直接接入到自己的业务流程中。 为了负责这项新业务,Meta 挖来了企业软件领域的资深管理者 CJ Desai 出任首席企业平台官,直接向扎克伯格汇报。CJ Desai 之前担任过 MongoDB 的首席执行官,也在 Cloudflare 和 ServiceNow 担任过核心高管。 Meta 表示,后续会把保护数据隐私和系统安全放在首位,帮助不同规模的公司借助 Meta 的 AI 工具提高运转效率、拓展客户群。 官方公告:
显示更多
梦回Flash,Opus 5.5直出火柴人打斗动画。 Opus 5.5的能力尚未被完全挖掘,下一个大版本会强到什么样简直无法想象。
Cursor是废了,Grok 4.7毫无进步,200美元档位的Cursor Ultra,第三方API额度也从400美元砍到100美元。 我发现了,马斯克这个人虽然很大方,但是从不吃亏。
元素叠满了,Steam里上了一个AI游戏。 AI生成的游戏素材、视频,Vibe Coding写的游戏代码,接入AI的NPC。修仙题材,还能双修。。。 地址:
显示更多
这是我的原贴,原贴里单独列出来尼日利亚订阅,是因为那时候尼日利亚区价格特别便宜,但是现在早就没优惠了,好歹把尼日利亚去掉吧。
显示更多
原来Claude封号有这么多风险.....
差不多GPT-6刚出的时候,我开始办云菲律宾身份,现在终于办好了,但是GPT-6被Opus 5.5淘汰了
发挥很稳定,总有彩蛋和惊喜