Black Forest 开源 FLUX.1 Kontex 模型,使用文本即可实现一键 PS
知名开源平台Black Forest开源了文生图模型FLUX.1-Kontext的开发者版本,该模型让用户通过自然语言就能实现一键P图。
Black Forest公布的测试数据显示,FLUX.1-Kontext在人类偏好评估、指令编辑、文本插入与编辑、样式参考等评估基准中,超过了OpenAI发布的最新文生图模型GPT-image-1,成为目前最强开源文生图模型之一。
FLUX.1 Kontext专注于图像编辑任务:包括迭代编辑、角色保持、局部与全局精细控制。
-
可以非常准确地“重绘”图片中的局部或全图,比如:
-
把帽子加到人物头上
-
改变背景风景
-
把原图中的狗换成猫,人物保持原样
-
-
多次修改也不会“跑偏”或者失真
-
跟很多流行工具(如ComfyUI)无缝结合,方便使用
模型下载:https://huggingface.co/black-forest-labs/FLUX.1-Kontext-dev
技术报告:https://arxiv.org/abs/2506.15742

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。
持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。
转载内容版权归作者及来源网站所有,本站原创内容转载请注明来源。
- 上一篇
腾讯开源轻量级混元-A13B 模型
腾讯宣布开源混元大模型家族的新成员——混元-A13B模型。该模型采用基于专家混合(MoE)架构,总参数规模达800亿,激活参数为130亿。 公告称,该模型在保持顶尖开源模型效果的同时,大幅降低了推理延迟与计算开销。对个人开发者和中小企业来说,极端条件下仅需1张中低端GPU卡即可部署。 在性能表现上,混元-A13B模型在数学、科学和逻辑推理任务中展现出领先效果。例如,在数学推理测试中,模型能够准确完成小数比较并展现分步解析能力。对于时下热门的智能体(Agent)应用,模型可调用工具,高效生成出行攻略、数据文件分析等复杂指令响应。 根据介绍,预训练中,混元-A13B模型使用了20万亿高质量网络词元语料库,提升了模型推理能力的上限;完善了MoE 架构的 Scaling Law(即规模定律)理论体系,为 MoE 架构设计提供了可量化的工程化指导,提升了模型预训练效果。 用户可以按需选择思考模式,快思考模式提供简洁、高效的输出,适合追求速度和最小计算开销的简单任务;慢思考模式涉及更深、更全面的推理步骤。这优化了计算资源分配,兼顾效率和准确性。 此外,混元还开源了两个新数据集。其中,Artifac...
- 下一篇
Embabel Agent —— Spring 之父出品的 JVM 的 Agent 框架
Embabel (Em-BAY-bel) 是一个在 JVM 上编写 agentic flows的框架,它将 LLM 触发的交互与代码和领域模型无缝融合。支持智能路径查找,以达到目标。它使用 Kotlin 编写,但提供了 Java 的自然使用模型。它出自 Spring 的创始人之手。 Actions:Steps an agent takes Goals:agent 试图实现的目标 Conditions:执行操作或确定目标是否已达成之前需要评估的条件。每次执行操作后都会重新评估条件。 Domain model:支撑流程并告知动作、目标和条件的对象。 Plan:为实现目标而采取的一系列行动。计划由系统而非程序员动态制定。系统会在每次行动完成后重新制定计划,使其能够适应新的信息并观察前一次行动的效果。这实际上是一个OODA 循环。 这些概念巩固了与其他 agent 框架的区别: 复杂的规划。通过引入真正的规划步骤,使用非LLM AI算法,超越有限状态机或嵌套顺序执行。这使得系统能够通过以新的顺序组合已知步骤来执行未编程的任务,并做出有关并行化和其他运行时行为的决策。 卓越的可扩展性和重用性:由...
相关文章
文章评论
共有0条评论来说两句吧...