首页 文章 精选 留言 我的
优秀的个人博客,低调大师

微信关注我们

原文链接:https://www.oschina.net/news/383304

转载内容版权归作者及来源网站所有!

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

微博推出 VibeThinker-1.5B,低成本 AI 模型挑战大型语言模型

微博的人工智能部门推出了开源的 VibeThinker-1.5B,这是一个拥有15亿参数的大型语言模型(LLM),基于阿里巴巴的 Qwen2.5-Math-1.5B 进行的精细调整。 尽管 VibeThinker-1.5B 体积小,但在数学和代码任务上表现出色,达到了行业领先的推理性能,甚至超越了体量达6710亿参数的竞争对手 DeepSeek 的 R1模型。该模型还与 Mistral AI 的 Magistral Medium、Anthropic 的 Claude Opus4和 OpenAI 的 gpt-oss-20B Medium 等多个大型模型抗衡,同时所需的基础设施和投资成本却少得多。 值得一提的是,VibeThinker-1.5B 在后期训练中仅花费了7800美元的计算资源,这一成本远低于同类或更大规模模型所需的数十万美元甚至数百万美元。LLM 的训练分为两个阶段,首先是预训练,模型通过大量文本数据学习语言结构和一般知识。之后的后期训练则使用更小的高质量数据集,使模型能够更好地理解如何提供帮助、进行推理和与人类期望对齐。 VibeThinker-1.5B 采用了一种名为 “谱...

李飞飞团队推出首款商用世界模型 Marble

科技媒体TechCrunch消息称,人工智能先驱李飞飞联合创立的World Labs公司近日正式发布首款商业化“世界模型”产品Marble,标志着AI空间智能领域迎来重要突破。该产品支持文本、照片、视频等多模态输入,可生成可编辑、可下载的3D环境,现已开放免费增值与付费订阅服务。此次发布距World Labs结束“隐身模式”并完成2.3亿美元融资仅一年有余,使其在该赛道领先竞品,目前Decart、Odyssey仅推出免费演示版,谷歌Genie仍处于有限研究预览阶段。 作为业内首款原生集成AI编辑工具的世界模型,Marble核心优势在于生成持久化3D环境,能减少场景变形与不一致性,支持导出多种格式,区别于同类动态生成模式。其在创意控制上实现多重突破:输入方式升级为多模态兼容,可生成高逼真数字孪生环境;创新3D编辑器Chisel实现“结构与风格”解耦,支持直接操控3D对象;还新增世界扩展功能与合成器模式,可实现多3D世界无缝拼接。此前World Labs早期模型及Beta版已展现3D生成能力,正式版进一步优化边缘形变等问题。 Marble首批聚焦游戏开发、影视视效、虚拟现实三大场景,同时在...

相关文章

发表评论

资源下载

更多资源
优质分享App

优质分享App

近一个月的开发和优化,本站点的第一个app全新上线。该app采用极致压缩,本体才4.36MB。系统里面做了大量数据访问、缓存优化。方便用户在手机上查看文章。后续会推出HarmonyOS的适配版本。

Mario

Mario

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长,特征是大鼻子、头戴帽子、身穿背带裤,还留着胡子。与他的双胞胎兄弟路易基一起,长年担任任天堂的招牌角色。

Nacos

Nacos

Nacos /nɑ:kəʊs/ 是 Dynamic Naming and Configuration Service 的首字母简称,一个易于构建 AI Agent 应用的动态服务发现、配置管理和AI智能体管理平台。Nacos 致力于帮助您发现、配置和管理微服务及AI智能体应用。Nacos 提供了一组简单易用的特性集,帮助您快速实现动态服务发现、服务配置、服务元数据、流量管理。Nacos 帮助您更敏捷和容易地构建、交付和管理微服务平台。

Spring

Spring

Spring框架(Spring Framework)是由Rod Johnson于2002年提出的开源Java企业级应用框架,旨在通过使用JavaBean替代传统EJB实现方式降低企业级编程开发的复杂性。该框架基于简单性、可测试性和松耦合性设计理念,提供核心容器、应用上下文、数据访问集成等模块,支持整合Hibernate、Struts等第三方框架,其适用范围不仅限于服务器端开发,绝大多数Java应用均可从中受益。

用户登录
用户注册