把跑出来的视频拖到剪映里面做了一下轻微的剪辑配乐
感觉效果很好了!就这样去做视频,比传送用AE手搓快了不知道多少倍啊!
用群友的skill来测MiniMax H3
跑出来的第一版,整体效果如果是100分的话我能够给到85分。
剩下的就是运镜、转场和配乐来后期处理的问题了!
能做到这个程度,我其实都感觉不用再打开我的AE了
顯示更多
用群友的skill来测MiniMax H3
跑出来的第一版,整体效果如果是100分的话我能够给到85分。
剩下的就是运镜、转场和配乐来后期处理的问题了!
能做到这个程度,我其实都感觉不用再打开我的AE了
顯示更多
有时候真的得承认,群里的大佬有点多。
昨天有人直接搞出了一个 MiniMax H3 的视觉包装设计 Skill。我一直没空测,刚刚空跑了一下,效果真的挺不错。
大概这就是社群有意思的地方吧。一个人闷头走,很容易自己把自己绕晕;但如果身边都是在认真做事的人,你总会被带着往前挪一步。
下一条,放我用这个 Skill 跑出来的效果。
顯示更多
有时候真的得承认,群里的大佬有点多。
昨天有人直接搞出了一个 MiniMax H3 的视觉包装设计 Skill。我一直没空测,刚刚空跑了一下,效果真的挺不错。
大概这就是社群有意思的地方吧。一个人闷头走,很容易自己把自己绕晕;但如果身边都是在认真做事的人,你总会被带着往前挪一步。
下一条,放我用这个 Skill 跑出来的效果。
顯示更多
Grok vs GPT
大家来对比一下两者的效果,说说Grok有哪里还可以改进的地方
prompt⬇️
冷白玩偶感柔焦社媒美妆近景风格、暗发包围面部极近竖幅头肩构图、成年真人玩偶感窄椭圆脸、灰褐大直径美瞳配放射状上下长睫毛、粉豆沙渐变水光微开唇、眼下双颊鼻尖淡粉红晕、深棕蓬松长发偏中分贴脸垂落、两束前景碎发在面中形成X形交叉、正视微张不露齿空灵疏离神情、小型银色镶钻环形耳饰、低领灰色软质上衣边缘、暗发暗灰无可辨环境背景、冷白高亮美颜、近轴正面柔闪配鼻尖下眼睑唇部小高光、低清社媒精修轻柔焦压缩质感
顯示更多
写提示词的时候,一写“电影感”,我以前也第一时间往里面加黑边、青橙、侧逆光、浅景深
这些东西加进去,画面确实会更偏向于电影感一些
但很多时候还是会觉得空
因为真正像电影的那一下,其实是:这一秒像从某件正在发生的事情里截出来的
有前后,有动作停在半路,也有关系
滤镜再怎么完美,其实也解决不了画面里什么都没发生这件事
顯示更多
两张图一张是 GPT-iamge-2.0 一张是 grok-iamge-2.0
你能够分辨出来哪一张是grok吗?
提示词⬇️
中国风高端艺术海报,水墨晕染背景,带有淡金色祥云和留白。
画面右侧用优雅的竖排书法字体清晰写着黑色大字「东方美学」,
左侧横排用现代宋体写着小字「传统与当代的对话」。
底部用细小的灰色楷体写着「限量艺术展 · 2026」。
文字清晰锐利、无变形,墨色自然,整体氛围高级、克制、有文化感,
高细节,专业海报排版
顯示更多
Grok Image 2.0 的精确编辑我还能怎么夸。
直接吹爆吧。
它不是整图重抽装精准,是图层先精确分层,每次改动只打单一图层,其它元素基本不受影响。
海报、产品图、卖点贴片这些场景,谁用谁知道有多狠。
顯示更多
Grok 终于克服了中文文字这块短板。
以前的中文文字变成了各种乱七八糟的符号
现在这种密密麻麻的历史信息图都能稳住,标题清楚,正文也能读。
而且也不一个很复杂的提示词,就简单的一句:一张高密度信息图,讲述中国的历史。
顯示更多
Announcing Imagine Image 2.0, our next generation image model with precision editing, crisp text rendering, improved factuality, and real world usefulness.
Image 2.0 helps you make images for real work.
顯示更多
写提示词的时候我以前也爱堆各种各样的元素:发簪、琵琶、酒托、莲花……。
总觉得东西一多,画面“有内容了”。
后来才发现不是这样。
画面中的元素之间如果不能承载这叙事的功能,有时候出现是没有意义何必要的,甚至会干扰读者的阅读视线
所以我渐渐的开始减少画面中出现的道具元素,来尝试着控制图片
顯示更多
Grok Image 2.0 的精确编辑我还能怎么夸。
直接吹爆吧。
它不是整图重抽装精准,是图层先精确分层,每次改动只打单一图层,其它元素基本不受影响。
海报、产品图、卖点贴片这些场景,谁用谁知道有多狠。
顯示更多
Grok 刚更的精确编辑也太离谱了。
不用你手抠,图丢进去它先自动分层。 发饰、扇子、裙子、项链、信贴,一层一层点开就能改。
我只动右下角空白信贴,写上「nuyoah creator build」。
就很准确的出图了(2s),而且效果还很好,妈呀,
这次是真的精确了……
顯示更多
Grok 刚更的精确编辑也太离谱了。
不用你手抠,图丢进去它先自动分层。 发饰、扇子、裙子、项链、信贴,一层一层点开就能改。
我只动右下角空白信贴,写上「nuyoah creator build」。
就很准确的出图了(2s),而且效果还很好,妈呀,
这次是真的精确了……
顯示更多
Grok 的生图模型更新了,新模型叫 Imagine Image 2.0。
这次重点不在一键出神图,更像往「能改」那边挪:区域精修、分割抠图、最多 5 张参考一起喂、Smart Resize 换比例,文字和布局也报了加强。Arena 生图和编辑榜自家说冲到第二,前面还是 GPT-image-2。
一更新我就拿了我的同一套人像提示词跑了两张。
第一张 GPT,第二张 Grok。
先不说榜,就这两张看:GPT 这张更像半夜随手拍,房间暗、颗粒在、蝴蝶夹和鱼骨别针这种小东西挺贴;Grok 脸更干净、光更顺、肩颈更工整,但也会更像精修棚拍,空气感少一点。
GPT 更「像真人拍的」,Grok 更「像修好的照片」。真要拉开差距,下一把我去测它吹的区域编辑。
顯示更多
Grok 的生图模型更新了,新模型叫 Imagine Image 2.0。
这次重点不在一键出神图,更像往「能改」那边挪:区域精修、分割抠图、最多 5 张参考一起喂、Smart Resize 换比例,文字和布局也报了加强。Arena 生图和编辑榜自家说冲到第二,前面还是 GPT-image-2。
一更新我就拿了我的同一套人像提示词跑了两张。
第一张 GPT,第二张 Grok。
先不说榜,就这两张看:GPT 这张更像半夜随手拍,房间暗、颗粒在、蝴蝶夹和鱼骨别针这种小东西挺贴;Grok 脸更干净、光更顺、肩颈更工整,但也会更像精修棚拍,空气感少一点。
GPT 更「像真人拍的」,Grok 更「像修好的照片」。真要拉开差距,下一把我去测它吹的区域编辑。
顯示更多
Announcing Imagine Image 2.0, our next generation image model with precision editing, crisp text rendering, improved factuality, and real world usefulness.
Image 2.0 helps you make images for real work.
顯示更多
我们看到的很多AI图都会出现这样一种情况
质感拉满,构图独特,点完赞要完提示词,自己照着出一张,过两天却怎么也想不起来它在讲什么。
只有一种印象:当时挺惊艳我的
这其实是因为图片里面缺乏了故事力
就比如我下面这张图片就是这样的效果
很好看,也很特别,但是除了这个就什么都没有了
所以我把这个坑拆开写了一篇如何增加画面叙事力的文章
⬇️
顯示更多
新的这个规则的想要获得收益的要求也太困难了,中推圈总的也就那么多人,如果这个时间线的算法如果不改的话,低粉(2-3w)以下的几乎都吃不到这个奖励了,这也太难了
以后就算每天都发原创,精力花进去了,但是也不见得有个响,想要吃到收益,要一天全都泡在x上了
顯示更多
这个短词的效果还真的不错,凑合凑合也够用了,分享一下
⬇️
将输入的2D插画、动漫图片、游戏立绘或数字绘画,转换为兼具原作还原度、真人真实感和高级审美的真人电影实拍画面!!!输入图片是人物设计、构图、动作、服装和场景的唯一参考。最终画面需要让观众能够立即认出原图角色,同时呈现为经过专业真人选角、电影级妆造、高级服装定制和专业摄影后的真人版本。
顯示更多
想写一个二次元转真人的提示词,刚开始写了很长很长的一个版本,效果不怎么理想,结果后来我把很多东西全删了之后,效果反而还好了一点……
也有可能是抽卡抽出来的结果还行,虽然虽然还是3d味很浓,估计可能是动作幅度的原因……
顯示更多
这张是论文一样长的提示词的2转3的效果,兄弟们可以和下面的那个帖子做个对比,觉得是长的效果好,还是短的效果好
⬇️
想写一个二次元转真人的提示词,刚开始写了很长很长的一个版本,效果不怎么理想,结果后来我把很多东西全删了之后,效果反而还好了一点……
也有可能是抽卡抽出来的结果还行,虽然虽然还是3d味很浓,估计可能是动作幅度的原因……
顯示更多
我在一定程度上怀疑lovart上的API接口有一些是中转站的接口,会突然之间导致生图的质量出现问题……
想写一个二次元转真人的提示词,刚开始写了很长很长的一个版本,效果不怎么理想,结果后来我把很多东西全删了之后,效果反而还好了一点……
也有可能是抽卡抽出来的结果还行,虽然虽然还是3d味很浓,估计可能是动作幅度的原因……
顯示更多
科研出来的一个动作提示词,给群里的好兄弟们测试玩玩,结果他们都说出出不出来,还有肢体混乱的问题。
其实吧这个主要还是GPT本身的能力问题
首先是色情违规问题,这无可厚非,抽卡就能解决的事情
然后二是这个动作涉及的肢体和空间的关系,很容易导致肢体残缺的失败或者服装的叠加和手臂的包裹,大概成功率只有10%左右
如果是在lovart上的sd 5.0 Pro的话成功率蛮高的,但是在即梦上的话就几乎成功不了
其实出现问题主要还是文生图的原因,若果想要简单话控制,那就采用线稿动作参考吧,几乎不会失败。
但是我研究的就是文生图,我始终觉得文字去表达让模型扩散才会有更多的可能,在不考虑成本效益的情况下,发挥创造力和随机感也是很有趣的一件事。
顯示更多
这个系列的最后三张图
这次的系列主要想讲的是画面的叙事感
画面第一眼看上去可能不会那么吸引人
但是看久了,会有一种情绪在里面
明天用文章拆开来讲讲
顯示更多
GPT写真系列之——复古私宅少女感写真
这组图是一套复古私宅少女感写真:海军蓝格纹造型贯穿全组,旧木家具与暖棕窗帘构成统一空间,通过桌面、镜子、钢琴、椅子等家具不断改变观看关系。
真正的识别点不是某个姿势,而是“深蓝少女造型 × 暖棕旧室 × 私密近距离观看 × 轻胶片颗粒”。
如果你也想做出同样风格的写真图片,可以尝试一下下面几个关键词:海军蓝复古私宅、35mm film photography、旧木家具框中框、门缝窥视、钢琴键盘低机位、窗帘夹层近景、自然半哑光、砖红唇、低双马尾深蓝丝带、头肩同向、私人相册感
顯示更多
做系列图的都知道,最难的不是第一百张,是第一张。
第一张图的本质不是"画一张图",是替整个系列做决定:风格走哪个方向、色板锁哪几个、光线逻辑是什么、角色长什么样、构图偏爱什么……这一张里塞着几十个决策。
做完第一张,后面突然变简单,不是因为你变强了,是因为决策做完了。剩下每张图都是"沿着已定轨道做变体"——变体生成比从零生成轻松一个量级。
下面这两个就是从之前的帖子延伸出来的
顯示更多
这样的质感,不仅要涉及到皮肤如何去描述,还要去写到画面里的光线,如果想要复刻的话,最好的方法是直接垫图作为参考,纯靠文字的话随机性太大了
顯示更多