今日运势评分

2

本月运势

癸未月

震荡偏多

辛生水,巳申合水
庚不经络织机虚张
辰不哭泣必主重丧

祭祀,作灶,纳财,栽种,纳畜,进人口

安葬,经络,修坟,破土,开市,安床,启钻,立碑

月相

既望

底部反弹

日冲

Powered by RitMEX

TRUMP10.22 9.48%

SUI3.53 9.76%

TON3.00 4.61%

TRX0.30 2.61%

DOGE0.20 13.04%

XRP2.84 16.47%

SOL165.32 5.73%

BNB690.61 3.33%

ETH2975.87 7.55%

BTC117759.90 6.04%

ETH Gas6.83 Gwei

贪婪
71

增强版 Sora 生图模型发布:不仅能直接在 ChatGPT 用,还抢了梗图作者的饭碗

官方带头画梗图。

在 DeepSeek 24 小时前刚刚发布了 V3 模型 0324 版本更新之后,OpenAI 似乎真的有点「不甘示弱」的较劲感,在北京时间 3 月 26 日凌晨宣布了新产品的发布预告。

虽然在正式开始之前,有一些传言猜测本次有可能发布 GPT-5,但根据以往 OpenAI 的各种产品发布节奏来看,这次并不会是一次重磅更新,但本次直播中,发布的整合进 ChatGPT 中的新版 Sora,还是给大家带来的意料之外的「节目效果」。

目前,整合进 ChatGPT 中的 Sora,相比于独立应用版本,能力暂时被局限在了图像生成,但据 OpenAI 在直播中介绍,该模型比之前的模型有了质的飞跃。

据介绍,开发团队使用了GPT-4o「全模态」(或可以生成文本、图像、音频和视频等任何类型数据的模型)能力为基础,来开发这个版本的 Sora。因此用户可以直接说出自己的需求,甚至上传或者拍一张照片,作为提示词来使用。

比如直播现场的演示环节,就直接用手机给 Sam Altman 在内的三人来了张自拍,并要求 Sora 生成一张「动漫风格的版本」。

这还没完,他们三人甚至还现场演示了让 Sora 在图片上添加一段文本「Feel The AGI」(感受通用人工智能)。现场画了第一张新版 Sora 的表情包。

这个现场生成的表情包不仅文本准确清晰,并且准确理解了当代流行梗图中的包括粗体字等必备元素,已经能直接拿来当梗图发到各种群里了。

由于是 OpenAI 官方带头整活,评论区也有不少用户也被激发热情,尝试着把相同的提示词喂给 Grok,用相同的提示词和照片,生成同样风格的内容 ———— 但显然效果还是比新版 Sora 差了不少,反而带来了更喜感的效果。

除了带头画梗图,OpenAI 还演示了新版本 Sora 在文本渲染方面的改进,可以让在图像上生成没有拼写错误的连贯文本的成功率明显提升。

在另一个演示场景中,OpenAI 团队让 Sora 去生成一幅用于理解相对论的漫画卡片。

不同于以往生图模型中,在文本生成部分经常容易变得混乱不堪,甚至是「AI 造字」的情况发生,新版 Sora 其原生图像生成,生成的文本,已经没有任何明显错乱,甚至还在漫画生成了非常自然流畅的日文,意外的让日文社区的不少日本用户「炸锅」。

对于图片生成模型来讲,过去正确渲染文本是一个巨大的挑战。如果小标题或文本元素有拼写错误或错误,整个图像都可能变得无法使用。

此外在这个案例中,OpenAI 还演示了类似对相对论这样「世界上现有知识」的正确引用。

「如果我画一张图像,我会受到自身技能的限制……以及我积累的所有世界知识的限制,」 ChatGPT多模态产品负责人 Jackie Shannon 在接受媒体采访时解释这个功能的必要性。

「该模型将世界知识代入其中,因此当你要求生成牛顿棱镜实验的图像时,你无需解释「牛顿棱镜实验」这件事它本身是什么,就能得到准确的图像。」

除了上述这些直播中提到的模型能力改进,OpenAI 还表示新版 Sora 大幅提升了在属性和对象之间保持正确关系的能力。例如,绑定能力较差的模型可能会将要求生成蓝色星星和红色三角形的提示词,生成为红色星星而没有三角形。

据 OpenAI 介绍,现有的大多数图像模型在这方面都很容易「犯错」,尤其是当被要求渲染多个项目(通常在5到8个左右)时,经常会混淆颜色和形状。而新版 Sora 的图像生成功能,可以正确绑定15到20个对象的属性,在理解各自的复杂需求的同时,保证不会被误导,从而大幅提高成功率。

除了这些使用体验上的改进,还有一个细节是,OpenAI 已经确认,新版 Sora 生成图像的时间比以前更长,但 OpenAI 认为这是一个值得的权衡。

「虽然我们在延迟方面肯定还有改进的空间……但(我们觉得)这些生成图片的质量、功能和世界知识,确实弥补了用户需要等待的额外几秒钟,」Shannon说。

至于生图领域的安全问题 —— 从去年到今年已经出现多次伪造名人不雅图像、热点事件虚假图像,以及 Google Gemini 去除照片原水印这样的问题,OpenAI 团队强调新版 Sora 已经可以去除照片水印,同时阻止生成性深度伪造图像,并拒绝生成相关的内容请求。同时所有生成的图像都将包含标准的C2PA元数据,以标记该图像是由OpenAI创建的。

目前,新版集成在 ChatGPT 内的 Sora 图像生成模型功能,已经开放给 Pro 和 Plus 订阅套餐的用户,并且 OpenAI 承诺,新版 Sora 也会在不久的将来,提供给免费版本和 API。

现在我最想做的,就是立即让它帮我画自己的梗图了。

欢迎加入深潮TechFlow官方社群

Telegram订阅群:https://t.me/TechFlowDaily
Twitter官方账号:https://x.com/TechFlowPost
Twitter英文账号:https://x.com/BlockFlow_News
作者张勇毅
相关文章
2025.07.11 - 3 小时前
国家金融与发展实验室副主任:人民币稳定币发展模式可“内外结合”
为了更好地实现战略统筹、主动监管、协同推进,应该考虑采取境内离岸与境外离岸人民币稳定币的联动发展模式。
2025.07.11 - 4 小时前
数字稳定币洗钱与恐怖融资初探:对 USDT 黑名单的链上追踪
只有在及时、协同、技术成熟的 AML/CFT 体系下,稳定币生态系统的合法性和安全性才能得到真正保障。
2025.07.11 - 4 小时前
图表解析比特币:后市将如何演绎?
机构采用仍是核心驱动力。
2025.07.11 - 4 小时前
实探稳定币在华强北:5 万个币起收,有灰色地带
仅有个别商家表示会使用或尝试使用稳定币进行交易。
2025.07.11 - 4 小时前
以太坊基金会变革开始,能否助 ETH 币价重回巅峰?
以太坊的未来,基金会来当「舵手」。
2025.07.11 - 4 小时前
上海信号:在「一国两制」下解读中国加密货币新棋局
7 月 10 日,上海国资委召开学习会,探讨加密货币与稳定币发展战略,引发比特币价格飙升。
2025.07.11 - 4 小时前
数据:全球企业今年累计购置超 72 万枚比特币
‍企业持有的比特币总量约占比特币总供应量的 3.6%。
2025.07.11 - 5 小时前
Vitalik 眼中的「AI 2027」:超级 AI 真的会毁灭人类吗?
无论未来 5-10 年 AI 如何发展,承认 「降低世界脆弱性是可行的」 并投入更多精力,用人类最新技术实现这一目标,都是值得尝试的道路。
2025.07.11 - 6 小时前
私募股权融资成风,4 家加密储备公司或面临股票下行压力
等待足够的流动性和市场价格效率形成后再入场,否则就是在玩一场只适合机构和对冲基金的危险游戏。
2025.07.11 - 6 小时前
流动性周期改道,你的资产跟上了吗?
我们还没到激增阶段。