IT之家 9 月 9 日消息,腾讯今日宣布混元图像模型 2.1 上新开源,支持原生 2K 生图和中英文原生输入。
腾讯还同步开源了“PromptEnhancer 文本改写模型”,输入“画一只可爱的猫”,会自动补全“橘色短毛猫趴在格子桌,爪边放饼干,水彩风”;支持中英文双向转换,用中文说“画带‘Dream’的星空蛋糕”,也能精准呈现,避免“表达模糊”。

混元图像模型 2.1 支持长达 1k tokens 的复杂语义超长 prompt,支持多主体分别描述与精确生成。
Prompt:一幅由四个画格组成的卡通漫画,以 2x2 的网格形式排列,讲述了一只变色龙的难题。左上角:一只卡通风格的变色龙趴在一片宽大的、呈翠绿色的植物叶子上。它的皮肤是与叶片完全相同的绿色,并带有浅绿色的纹理细节,实现了完美的伪装,几乎与背景融为一体。变色龙的大眼睛好奇地转动着,身体姿态放松,场景背景是模糊的绿色丛林。右上角:同一只变色龙正从叶子边缘爬到一根粗糙的、呈深棕
 
                                     
                                     
                                     
                                     
                                     
                                     
             
             
             
             
             
             
             
             
             
             
             
             
             
             
             
             
             
             
             
             
             
             
            