首页 文章 精选 留言 我的

精选列表

搜索[SVG格式],共10000篇文章
优秀的个人博客,低调大师

Apache Arrow 4.0.1 发布,内存数据交换格式

Apache Arrow 4.0.1 现已发布。Apache Arrow 是 Apache 基金会的顶级项目之一,目的是作为一个跨平台的数据层来加快大数据分析项目的运行速度。它包含一组规范的内存中的平面和分层数据表示,以及多种语言绑定以进行结构操作。 它还提供低架构流式传输和批量消息传递,零拷贝进程间通信(IPC)和矢量化的内存分析库。 主要更新内容 [Python][C++] 在 v4.0.0 中转换 int64 的切片 ListArray 时出现段错误 [R][Packaging] 修复 r/configure 中的 pkg-config 检查 [R] open_dataset 在使用 select 时忽略提供的模式 [R][Packaging] 数据集,在 autobrew 和 CRAN Mac 版本中关闭 Parquet [Python] pyarrow.orc.write_table 签名与 pyarrow.parquet.write_table 的签名相反 [Python] 在 Flight 服务器中读取 CSV 时出现段错误 [R] LIBARROW_MINIMAL、LIBARROW_DOWNLOAD、NOT_CRAN 环境变量不应该区分大小写 [C++] 使用 nvcc 11.2 编译 arrow header 时出现段错误 [C++] extract_regex 在空值或不匹配后会出现异常行为 [Go][Flight] 客户端身份验证处理程序覆盖传出的元数据 [Python] 超出范围的负数片产生无效的数组 [C++][Compute] replace_substring_regex() 创建无效数组 => 崩溃 [Archery][Integration] 修复 write_js_test_json 中十进制大小写的生成 [R] 传递新的 UCRT CRAN windows 构建 [R] 小规模的文档更新 [R][CI] 使用 valgrind 每晚运行 R [JS] 简化 NodeJS 中的 UTF8 处理 [Python] pyarrow sdist 不需要git [Python] test_write_to_dataset_filesystem 缺少数据集标记 详情请查看更新公告。

优秀的个人博客,低调大师

Apache Arrow 3.0.0 发布,内存数据交换格式

Apache Arrow 3.0.0 发布了,该版本包含 2.0.0 发布以来修复的 678 个问题。Apache Arrow 是 Apache 基金会的顶级项目之一,目的是作为一个跨平台的数据层来加快大数据分析项目的运行速度。它包含一组规范的内存中的平面和分层数据表示,以及多种语言绑定以进行结构操作。 它还提供低架构流式传输和批量消息传递,零拷贝进程间通信(IPC)和矢量化的内存分析库。 部分更新内容 [Python] 将 Combine_chunks 方法添加到 ChunkedArray [Rust] [Parquet] 修复 ArrowReader 在某些时间戳类型上失败的问题 [R] 修复文件不存在时,read_feather 会在 R 中导致段错误的问题 [Rust] 不再需要缓冲区的内存对齐 [R] 修复Arrow 不会释放未使用的内存的问题 [Python] 支持 MapType 和 StructType 以增强 PySpark 集成 [Rust] 添加对十进制数据类型的支持 [C++][Parquet] 实现 parquet::FileMetaData::Equals [Python] 从支持列表中删除 Python 3.5 [Python] 在 PyArrow 中公开 GetRecordBatchReader API [R] 为算术内核添加绑定 [Rust] 将其他数组类型移动到其自己的模块中 详细内容请查看更新公告。

优秀的个人博客,低调大师

Apache Arrow 0.17.1 发布,内存数据交换格式

Apache Arrow 0.17.1 已发布。Apache Arrow 是 A以及多种语言绑定以进行结构操作。 它还提供低架构流式传输和批量消息传递,零拷贝进程间通信(IPC)和矢pache 基金会的顶级项目之一,目的是作为一个跨平台的数据层来加快大数据分析项目的运行速度。它包含一组规范的内存中的平面和分层数据表示,量化的内存分析库。 此版本增加了不少新功能和改进,以及修复 bug: 新功能和改进 ARROW-8501- [Packaging][RPM] 在 CentOS 6 上将devtoolset 升级至版本8 ARROW-8549- [R] 0.17 版本发布后的各项清理工作 ARROW-8699- [R] 修复 automatic r_to_py 自动转换 ARROW-8758- [R] 升级与 dplyr 1.0 的兼容性 ARROW-8786- [Packaging][rpm]在 CentOS 8 构建中使用绑定的 zstd Bugfix ARROW-8503- [Packaging][deb] 修复无法为RC 版构建 apache-arrow-archive-keyring 的问题 ARROW-8505- [Release][C#] “sourcelink test” 无法通过 Apache.Arrow.AssemblyInfo.cs 测试 ARROW-8584- [Packaging][C++] 在 deb 构建中出现 Protobuf 链接错误 ARROW-8608- [C++]将vendored mpark/variant.h 升级到最新版本以修复 NVCC 编译问题 ARROW-8609- [C++] ORC JNI 桥接器会在空的 arrow 缓冲区出现崩溃错误 ARROW-8641- [Python] Regression in feather: 不再支持列选择中的 permutation 详情查看发布说明 下载地址

优秀的个人博客,低调大师

Idea里面老版本MapReduce设置FileInputFormat参数格式变化

我们随便百度一个经典的MapReduce程序----wordcount的时候,在设置job文件输入路径和输出路径参数时,会看到别的博主会这么写: Configuration conf = new Configuration(); Job wordCountJob = Job.getInstance(conf); //省略。。。。 FileInputFormat.setInputPaths(wordCountJob,"hdfs://192.168.77.70:9000/wordcount/srcdata/"); FileOutputFormat.setOutputPath(wordCountJob, new Path("hdfs://192.168.77.70:9000/wordcount/output/")); 但是我在Idea里面复制粘贴编译时,其实是报错的。这是因为,我导的是老版本的包,但是也能运行,代码要稍作修改,它在版本中要求FileInputFormat调用的方法名是addInputPath且第一个参数是JobConf型,同样FileOutputFormat调用的输出名是setOutputPath,参数也是JobConf型。所以这个时候要进行强转,具体做法如下: FileInputFormat.addInputPath((JobConf)wordCountJob.getConfiguration(),new Path(args[0])); FileOutputFormat.setOutputPath((JobConf)wordCountJob.getConfiguration(),new Path(args[1]));

资源下载

更多资源
Mario

Mario

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长,特征是大鼻子、头戴帽子、身穿背带裤,还留着胡子。与他的双胞胎兄弟路易基一起,长年担任任天堂的招牌角色。

腾讯云软件源

腾讯云软件源

为解决软件依赖安装时官方源访问速度慢的问题,腾讯云为一些软件搭建了缓存服务。您可以通过使用腾讯云软件源站来提升依赖包的安装速度。为了方便用户自由搭建服务架构,目前腾讯云软件源站支持公网访问和内网访问。

Spring

Spring

Spring框架(Spring Framework)是由Rod Johnson于2002年提出的开源Java企业级应用框架,旨在通过使用JavaBean替代传统EJB实现方式降低企业级编程开发的复杂性。该框架基于简单性、可测试性和松耦合性设计理念,提供核心容器、应用上下文、数据访问集成等模块,支持整合Hibernate、Struts等第三方框架,其适用范围不仅限于服务器端开发,绝大多数Java应用均可从中受益。

WebStorm

WebStorm

WebStorm 是jetbrains公司旗下一款JavaScript 开发工具。目前已经被广大中国JS开发者誉为“Web前端开发神器”、“最强大的HTML5编辑器”、“最智能的JavaScript IDE”等。与IntelliJ IDEA同源,继承了IntelliJ IDEA强大的JS部分的功能。

用户登录
用户注册