注册并分享邀请链接,可获得视频播放与邀请奖励。

Ren
@Ryrenz
🇺🇸 美国全栈程序员 💻 ⚙️ 整理小白能懂的优质 AI 教程 📚 📢 持续挖掘实用的 AI 提效方式 🤖 💰 分享我关于投资、副业、职场的思考 🧠 📝 开源我所有的内容创作与 AI 变现经验 📈
加入 March 2025
675 正在关注    9.8K 粉丝
🎯 专门做海报生成的开源模型,港科大和美团一起搞的 对应论文 arXiv 2506.10741,14 位作者,来自港科大广州、美团、厦大和新国大 AI 生图这两年进步飞快,但做海报一直是重灾区:画面能出,一放中文标题就露馅,字缺笔画、排版歪斜,最后还得回 PS 重新排字。 PosterCraft 是奔着这个问题去的,训练分四个阶段:先做文本渲染优化,再用高质量海报微调,然后上美学文本强化学习,最后加视觉语言反馈。配套开放了 PosterCraft-v1_RL 和 v1_Reflect 两个模型,以及 Text-Render-2M、HQ-Poster-100K、Poster-Preference-100K、Poster-Reflect-120K 四个数据集。 推理代码、Gradio 界面都给了,还专门提供了 CPU 卸载版本给显存吃紧的机器。 有一点值得如实说明:在项目自己列的基准里,文本召回率、F-score 和准确率分别是 0.787、0.774 和 0.735,而同表中 Gemini2.0-Flash-Gen 的三项都略高一些。它的价值在于开放权重和完整数据集,不是绝对性能第一。 能自己部署和微调的模型,长期价值往往更高。 GitHub:
显示更多