註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

檢索結果 GPT图像分析
GPT图像分析 貼吧
一個關鍵字就是一個貼吧,路徑全站唯一。
建立貼吧
用戶
未找到
包含 GPT图像分析 的搜尋結果
思来想去,GPT-Image2 最牛的应用场景其实是:算命。 我把自己的手掌照片扔给它,它直接给出了带预警的详细分析,看完真的有点惊到。玄学这件事,本质上是把人类已有的规律和经验,通过图像进行结构化解读。 AI 在这块其实特别适合做。 我整理了一个目前效果最好的提示词,直接复制就能用: 给你这张手掌照片,请用中国传统玄学(八字、紫微斗数、手相)、指纹学以及中医学理论,进行深度分析。 要求: 1. 用易经和中医学理论进行分析,要给出精准预警和洞见,让人觉得有参考价值。 2. 用线条在图片上直接标注出每个关键点,并清晰说明含义。 3. 至少给出10个维度的分析报告,包含事业、财运、健康、感情、性格等。 4. 分析要客观且有结构,不要过于玄乎,要结合掌纹特征给出具体解读。 给你这张手掌照片,请用中国传统玄学(八字、紫微斗数、手相)、指纹学以及中医学理论,进行深度分析。 使用建议:可以补充自己的出生年月、性别、目前遇到的困惑(比如事业、感情、健康等),AI 会给出更针对性的分析。 想看更狠的洞见,可以在提示词最后加一句:“请大胆一点,泄露天机”。 想专注某个方向,可以直接指定,比如只分析财运或感情线。 这个玩法目前我试下来,确实是目前图像类 AI 里比较有意思的应用之一。你敢把自己的手掌照片扔给 AI 算命吗?🫪#AI算命# #GPT图像分析# #手相# #玄学# #AI应用#
顯示更多
0
11
19
3
轉發到社區
GPT-5.5 Instant 现已发布,减少啰嗦和车轱辘话,为用户提供更加简洁和准确的答复。该模型在事实准确性方面有明显提升,虚假陈述比 5.3 减少 52.5%,在图像分析和 STEM 相关问题上的表现也非常好,现在该模型作为默认模型向所有 ChatGPT 用户提供,开发者也可以通过 API 调用:
顯示更多
0
36
11
2
轉發到社區
现在对AI模型能力有个挺明确的感受:不再有谁全面领先,关键看你拿它干什么。ChatGPT、Claude、Gemini三家走了完全不同的路,各自的长板短版现在看得清清楚楚。要是你只盯着一家用,碰上不对口的任务,等于拿着锤子找钉子。 先交代一下版本,2026年5月这三家的旗舰分别是OpenAI的GPT-5.5、Anthropic的Claude Opus 4.7,还有Google的Gemini 3.1 Pro。 ChatGPT像个工具箱,什么都往里装。 它的产品矩阵最全,一个订阅下来,GPT Image 2多模态生图、Sora视频生成、Code Interpreter上传数据跑代码分析、Deep Research自动联网爬几十个网页出报告、Codex做编程agent,基本不用再去别处凑工具。语音对话也是三家里面最自然的,语气有起伏,不僵硬,拿来练口语或者做语言交换,体感最好。商业策略类的推理,有第三方盲测对比过,像“竞争对手降价你怎么应对”这种结构性问题,ChatGPT表现排第一。加上它是第一个跑出来的,插件生态、自定义GPTs的成熟度,其他两家暂时还追不上。 Claude走的是精度路线,尤其写作和代码。 中英文输出最不像AI写的,能贴着你的风格要求走,不会冒出那种千篇一律的填充感。有个134人参与的盲测,写作类比拼Claude几乎是碾压式赢下来的。指令遵循也最稳,你给一长串带各种约束条件的复杂指令,它漏掉条件或者跑偏的概率最低。法律文书、合规文档、结构化文档这些高精度场景,Claude的可靠性很突出。代码方面,Claude Opus 4.7在SWE-Bench Pro这个真实世界编程基准上处于领先,复杂代码、大型代码库重构、架构理解,很多专业开发者把Claude Code当首选。上下文支持1M token,整本书、整个代码库、超长合同丢进去,深度理解和连贯性都强。还有一个Cowork功能,是三家里面唯一能直接在你电脑文件夹里干活的,浏览文件、处理、生成交付物,都在本地操作。 Gemini的多模态理解和Google生态绑定是它最硬的两张牌。 图像、视频、音频理解,Gemini 3.1 Pro在三家里最强。举个例子,你给它一段健身视频,它能根据动作给你反馈;你录一段自己说英语的音频,它能纠正发音。这种视频音频层面的理解,ChatGPT做起来慢,Claude基本做不了。然后Google全家桶原生集成,Docs、Sheets、Gmail、Drive、Meet全通,如果你的工作生活跑在Google Workspace上,Gemini可以直接在你的文档和邮件里动手干活。上下文窗口也最大,1M到2M token,处理超大文档集合或者超大代码库,容量优势明显。搜索能力天然整合Google,做需要大量网络信息的研究或者快速查证,它最接地气。响应速度通常也是三家最快。 所以现在没有什么“最好”的AI,只有最适合你手上那件事的AI。你要全功能覆盖、语音交互、商业策略分析,ChatGPT合适。你要高质量写作、精准遵循指令、复杂代码重构、长文档深度阅读,或者需要AI直接在本地文件夹里操作,Claude是首选。你要是频繁处理视频音频图像、深度依赖Google生态、需要超长上下文或者快节奏联网研究,Gemini最顺手。 按任务类型简单速查一下: 写作类(中英文、风格跟随、避免AI腔):Claude。 复杂编程、代码库重构:Claude。 多模态理解(图、视频、音频分析):Gemini。 长文档深度阅读(整本书、超长合同):Claude或者Gemini,前者连贯性强,后者容量更大。 商业策略推理、结构化问题:ChatGPT。 语音对话、口语练习:ChatGPT。 直接操作本地文件夹:Claude的Cowork。 Google生态内干活(邮件、文档、表格):Gemini。 联网研究、大量信息查证:Gemini。 产品功能集成度、一站式解决:ChatGPT。 #AI# #AIAgent#
顯示更多
终于,终于有人把所有模型缝合到一起了😭 Claude Code 编码、codex生图、检索抖音,小红书,youtube x的热点信息……全在一个工作台里 这就是我一直在等的“缝合怪max”!! 以前我得开五六个客户端,Claude 写完复制到 Midjourney 出图,再切到 Codex 写代码,脑子都要炸了 现在 dethink 直接把这些全塞进来了 一个界面切遍所有模型——Claude、Grok、Gemini、DeepSeek、Kimi、GLM 关键是 Claude Code 和 Codex 也在里面,编码、写作、生图,一个工作台全干了 更爽的是什么?微信、支付宝直接付款 不需要外币卡,不需要找代充,不需要担心封号 $20 / $100 / $200 三档套餐,按 token 计费,用多少算多少 以前想用多个模型,要么分别订阅(每个月固定扣费,用不用都得付),要么来回切账号 dethink 按 token 计费,$20 / $100 / $200 三档,用多少算多少 对我这种有时候用得多、有时候用得少的人来说,这种灵活性才是真正省钱的地方 而且所有模型在一个工作台里,Claude 写文案、Grok 出图、Gemini 做分析,切换无缝 省下的不只是钱,是那种"终于不用管支付问题、不用来回切工具“的心智负担 还有三个让我意外的点: 1. 数据聚合直接内置 想查抖音、小红书、YouTube、X 的热点?直接在 dethink 里搜 以前我得开 Semrush、飞瓜、新榜好几个工具,现在一个地方全搞定 做选题、找热点、SEO 分析,效率直接翻倍 2. 图像生成的组合玩法 你可以用 Claude 理解需求、优化提示词,然后调用 GPT Image 2 或 Grok Image 出图 相当于把“最会理解人话的模型”和“最会画图的模型”组合起来用 以前我得在 Claude 和 Midjourney 之间来回复制粘贴,现在一句话搞定 3. 桌面端真的好用 Windows 和 macOS 都支持,本地文件直接拖进去就能让 AI 处理 做 Agent 任务、跑工作流,比网页版丝滑太多 现在 dethink 8月15日刚上线,前 500 名注册直接送 $5 使用额度 给大家申请了8折优惠码,限量500个!先到先得了:DETHINK2026 如果你也在用多个 AI 工具,每个月为订阅费头疼 或者你想用海外模型但支付一直是个坎,真的可以试试 dethink 链接:
顯示更多
0
66
83
20
轉發到社區
我从小做的梦都是稀奇古怪脑洞很大,不知道是不是因为小时候喜欢看推理和凡尔纳科幻小说。很早就做过穿越到古代的梦,反复出现。有时候甚至想过把梦境里的故事写成小说,无奈记性不好,毕竟也是黄粱一梦罢了。有机会的话用 seedance来“续梦”也不错。以下四张图用 gpt图像模型生成。
顯示更多
兄弟们 这个创意牛P啊 3D 趣味互动科学应用 用GPT生成图像,然后使用Gemini 3.1 Pro生成,可以将任何知识的内容制作成3D可交互的效果展示! 效果炸裂!
顯示更多
0
64
891
142
轉發到社區
兄弟们以后别说中国模型不行了。 现在老外整个 AI 技术栈,都直接换成中国模型了。 成本降了 87%,收入没掉。 推理后端:Opus 4.8 换 Kimi K2.7,差 8%,便宜 11 倍。 代码:GPT-5.5 换 Qwen 3.7 Max,差 18%,便宜 7 倍。 Agent 工具调用:Sonnet 4.7 换 GLM 5.2,差 3%,输入便宜 5 倍。 批量任务:GPT-5.5 mini 换 MiMo V2.5,差 6%,便宜 12 倍。 图像:GPT-Image-2 换 Wan 2.5,差 5%,便宜 8 倍。 视频:Sora 2 换 Kling 3.0,效果差不多,便宜 6 倍。 跑了 30 天: 成本 -87%,质量平均只掉 4%,收入不变。 更离谱的是,本地可跑,数据不出门,还不用天天担心哪天被封。 这哪是迁移。 这是把账算的明明白白了。
顯示更多
0
43
195
31
轉發到社區
GPT-Image2生成的图像逼真到让人不安,为什么越像真的反而越让人害怕?这种不适感在警告我们什么? 这些…全是…gpt image 2生成的ai图… #AI# #AIAgent#
顯示更多
现在图像生成模型真的已经进入到下一个阶段了! 我今天让 chatgpt 生成训练计划的示意图(左图),模型走的 GPT Image 2,小地方还有些问题,但瑕不掩瑜,基本可用了。 右图是用的 grok,感觉生成的图片差了两个版本,完全没有跟上时代。 @elonmusk
顯示更多
0
16
35
6
轉發到社區
一种有趣的新图像玩法 把任何现实中的场景还原回2000年的3d游戏质感 提示词 GPT和Gemini都适用 帮我把这张照片重制为早期 Source 引擎(起源引擎初代)风格的 3D 游戏截图。保留原图的主体、构图、视角和场景布局,但把整个画面重新诠释为《Half-Life 2》或 Garry’s Mod 早期地图中的场景。整体不是简单滤镜,而是像把现实照片“重新建模”成一张老游戏截图。画面角色能清晰的看到低多边面的棱角,角色五官不要出现任何圆润的图形,全部用棱角或多边形代替;画面添加杂色,纹理极细的低像素格子,轻微色差效果渲染。风格要求: 3D建模:所有物体、角色、树木、岩石、建筑都呈现明显的**低多边形(Low-Poly)**建模感,边缘略硬,几何感明显 。模仿《半条命》(Half-Life)或Garry'sMod的早期视觉质感;材质贴图:使用低分辨率(Low-Res)纹理,贴图略糊、略重复、细节有限,带有早期游戏资产的粗糙感 。光影效果:模拟早期引擎特有的混乱、生硬光影、略不自然的光照;
顯示更多