xinference 0.13.0 版本发布-低调大师

xinference 0.13.0 版本发布

2024-07-08 566

🎉 Xinference v0.13.0 正式发布！Apple M系列专用后端 MLX 来临，Mac 上加速高达 40% 🚀。目前已支持 qwen2 和 gemma-2。阿里云镜像也如约而至，且容量大幅缩减，解决大家在国内拉取 docker 的痛点。详细更新内容如下：

- 新增内置支持模型 📦
- qwen2 gguf格式 📝
- gemma-2-it 💻

- 新功能 🚀
    - transformers推理后端支持开启continuous batching(连续批处理)，优化LLM同时服务多请求的吞吐。支持generate / chat / vision任务，欢迎试用。详见：https://inference.readthedocs.io/zh-cn/latest/user_guide/continuous_batching.html 📊
    - 支持mac arm芯片平台下的高速推理引擎MLX
    - 官方GPU镜像以vllm镜像为基础进行重构。大幅减少镜像体积，要求宿主机cuda版本12.4+和nvidia驱动版本550+。详见：https://inference.readthedocs.io/zh-cn/latest/getting_started/using_docker_image.html 🎥
    - 官方镜像支持从阿里云服务中拉取。详见：https://inference.readthedocs.io/zh-cn/latest/getting_started/using_docker_image.html ☁️
    - 新增更多日志模块。现在与请求相关的详细的uvicorn日志将被记录在日志文件中，同时transformers和vllm在命令行和文件中也会有更详细的日志 📑

- BUG修复 🐛
- 修复glm4 tool call的问题 🔧
- 修复rerank接口curl和python客户端返回documents行为不一致的问题 📜
- 更新glm4v模型的版本号，修复多GPU使用等若干问题。已下载的用户删除后重新下载即可 🔄
- 修复LLM为基础的rerank计算报错的问题 💡
- 修复deepseek-vl-chat模型缺少依赖的问题 🔗

- UI相关 💻
- 优化鉴权模式下的使用体验 🔐

微信关注我们

原文链接：https://www.oschina.net/news/301038/xinference-0-13-0

转载内容版权归作者及来源网站所有！

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

Diboot 低代码 v2.11.0 发布，带来系列优化与更新

这是v2.x的优化累积升级版本，包括一些重要优化、依赖更新、bugfix 等内核 diboot-core & core starter v2.11.0 优化：字典选项数据查询支持缓存（默认内存缓存，启用Redis则使用Redis缓存）优化字段名转列名映射，支持连续大写命名的模糊匹配优化BindCount赋值逻辑，无count值时设置为0 Bugfix：修复 isSimpleClassType 可能触发NPE的问题 fix 修复PropInfo初始化字段错误修复 DynamicQueryMapper跳过数据访问控制的问题 fix 修复SqlExecutor在事务中使用导致链接关闭升级：升级依赖至最新（Spring boot v2.7.18，Mybatis-plus v3.5.7） IAM组件 diboot-IAM starter v2.11.0 优化：升级依赖版本：shiro 至 v1.13.0 等定时任务组件 diboot-scheduler starter v2.11.0 优化：组件初始化SQL时自动写入定时相关字典数据优化定时任务加载失败抛出堆栈异常...

2024-07-08

410

2024年7月8日，人人可用的开源数据可视化分析工具DataEase正式发布v2.8.0版本。这一版本的功能变动包括：图表方面，新增组合图、热力地图、符号地图、K线图等图表类型，并对已有的仪表盘、明细表、指标卡、富文本等图表类型进行了功能增强和优化；仪表板和数据大屏方面，新增一键全屏预览和大屏刻度尺功能，分享链接支持Ticket设置。 X-Pack增强包方面，新增插件管理模块，支持自定义图表插件和数据源插件；CAS（Central Authentication Service，即中央认证服务）新增支持https模式；定时报告中支持使用过滤组件功能。新增功能 ■ 图表：支持分组柱线组合图、堆叠柱线组合图、热力地图、符号地图和K线图 DataEase v2.8.0版本中新增分组柱线组合图、堆叠柱线组合图、热力地图、符号地图和K线图。DataEase正在持续丰富图表图库，增强数据的展示能力，为数据在对比、空间、分布等场景下的呈现提供更多的选择。 ▲ 图1 分组柱线组合图、堆叠柱线组合图、热力地图、符号地图、K线图编辑页面 ■ 仪表板和数据大屏：支持全屏预览和大屏刻度尺在DataEase...

2024-07-08

429

资源下载

更多资源

腾讯云软件源

为解决软件依赖安装时官方源访问速度慢的问题，腾讯云为一些软件搭建了缓存服务。您可以通过使用腾讯云软件源站来提升依赖包的安装速度。为了方便用户自由搭建服务架构，目前腾讯云软件源站支持公网访问和内网访问。

Nacos

Nacos /nɑ:kəʊs/ 是 Dynamic Naming and Configuration Service 的首字母简称，一个易于构建 AI Agent 应用的动态服务发现、配置管理和AI智能体管理平台。Nacos 致力于帮助您发现、配置和管理微服务及AI智能体应用。Nacos 提供了一组简单易用的特性集，帮助您快速实现动态服务发现、服务配置、服务元数据、流量管理。Nacos 帮助您更敏捷和容易地构建、交付和管理微服务平台。

Rocky Linux

Rocky Linux（中文名：洛基）是由Gregory Kurtzer于2020年12月发起的企业级Linux发行版，作为CentOS稳定版停止维护后与RHEL（Red Hat Enterprise Linux）完全兼容的开源替代方案，由社区拥有并管理，支持x86_64、aarch64等架构。其通过重新编译RHEL源代码提供长期稳定性，采用模块化包装和SELinux安全架构，默认包含GNOME桌面环境及XFS文件系统，支持十年生命周期更新。

Sublime Text

Sublime Text具有漂亮的用户界面和强大的功能，例如代码缩略图，Python的插件，代码段等。还可自定义键绑定，菜单和工具栏。Sublime Text 的主要功能包括：拼写检查，书签，完整的 Python API ， Goto 功能，即时项目切换，多选择，多窗口等等。Sublime Text 是一个跨平台的编辑器，同时支持Windows、Linux、Mac OS X等操作系统。