Divooka.DataAnalytics.zh
Divooka.DataAnalytics.ConversionHelpers.GetExcelColumnName()
获取列名(以字母表示)。
Parameters
| Name | Description | Default |
|---|---|---|
columnNumber |
假设列 A 对应列号 1 | |
zeroIndexed |
指示输入列索引是否为零基础。 |
列名
返回列名字符串。
Divooka.DataAnalytics.ConversionHelpers.GetExcelColumnIndex()
将Excel样式的列名称(例如,“A”,“B”,“AA”)转换为相应的列索引。
Parameters
| Name | Description | Default |
|---|---|---|
columnName |
要转换的列名称。 | |
zeroIndexed |
指示输出索引是否应为零基础。 |
列索引
相应的列索引(基于1或基于0,具体取决于zeroIndexed参数)。
Divooka.DataAnalytics.ConversionHelpers.ParseExcelCellCoordinate()
解析Excel样式的单元格引用(例如,“A1”,“BC12”)为其数字行和列索引。
Parameters
| Name | Description | Default |
|---|---|---|
cell |
单元格引用字符串。 | |
zeroIndexed |
指示输出的行和列索引是否应为零基础。 |
包含解析的行和列索引的元组
包含解析的行和列索引的元组。
Divooka.DataAnalytics.DivookaDataColumn.InvalidValueTypeHandlingPolicy.ThrowException
抛出异常
Divooka.DataAnalytics.DivookaDataColumn.InvalidValueTypeHandlingPolicy.DBNullify
将该值设置为 DBNull
Divooka.DataAnalytics.DivookaDataColumn.InvalidValueTypeHandlingPolicy.Keep
保留新值而不修改列类型
Divooka.DataAnalytics.DivookaDataColumn.InvalidValueTypeHandlingPolicy.InitializeDefault
使用列类型初始化默认值
Divooka.DataAnalytics.DivookaDataColumn.InvalidValueTypeHandlingPolicy.ChangeColumnToMixedType
将列类型改为 object
Divooka.DataAnalytics.DivookaDataColumn.InvalidValueTypeHandlingPolicy.ChangeColumnToStringType
改变并转换现有值和列类型为 string
Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy
Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.ThrowException
抛出异常
Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.DBNullify
将该值设置为 DBNull
Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.Keep
保留新值而不修改列类型
Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.InitializeDefault
使用列类型初始化默认值
Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.ChangeColumnToMixedType
将列类型改为 object
Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.ChangeColumnToStringType
改变并转换现有值及列类型为 string
Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.Drop
Remarks
必须由调用者间接处理。
Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.ForwardFill
使用之前的有效单元格值填充。
Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.BackwardFill
使用之后的有效单元格值填充。
Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.LinearlyInterpolate
对数值进行线性插值,填充空缺。
Remarks
可能更适合作为针对特定列类型的预处理操作。
Divooka.DataAnalytics.DivookaDataColumn.Add``1()
Remarks
列类型由第一个添加的元素决定。
Divooka.DataAnalytics.DivookaDataColumn.TryGetDataAs()
尝试将数据转换为目标类型,可选地指定无效值处理策略。
转换结果
返回转换后的数据或相应的处理结果。
Divooka.DataAnalytics.DivookaDataColumn.Distinct()
获取不同的值作为字符串;如果列包含空值,可以选择忽略空值。
将空表示为 "<NULL>"。
Parameters
| Name | Description | Default |
|---|---|---|
ignoreNull |
是否忽略空值 |
返回字符串值列表
返回一个字符串值的列表
Divooka.DataAnalytics.DivookaDataGrid
一个面向程序员/纯C#/Parcel的表格数据API,具有多种灵活功能。
面向对象:行为对象,列是对象的属性。标头因此是这些属性的名称。某些函数内置了这些假设以实现优化。
请注意列名可以是任何内容,这可能会影响后续显示和处理(例如传入SQL时重复的列名会有问题,或在WPF中直接显示时列名包含 / 会无法正确绑定)。
Remarks
通常情况下,对于较小的返回结果,我们更偏向使用数组而不是 IEnumerable,因为这避免了在调用端多调用一次函数(例如 ToArray)。
TODO: 与 Parcel.Math.Types.Vector 类型进行合并
TODO: 使此类型完全不可变。
Divooka.DataAnalytics.DivookaDataGrid.Preformatting()
自动将字符串解析为可能的强类型对象
Parameters
| Name | Description | Default |
|---|---|---|
inputValue |
预处理结果
返回处理后的 DataGrid(内部修改或新对象)。
Divooka.DataAnalytics.DivookaDataGrid.#ctor
初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例。
Remarks
此默认构造函数创建一个空的 DataGrid,其使用默认设置。
结果
返回一个新的数据列表实例。
Divooka.DataAnalytics.DivookaDataGrid.#ctor()
使用指定的表名和来自 System.Dynamic.ExpandoObject 的数据初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例。
Remarks
该构造函数从提供的 System.Dynamic.ExpandoObject 中提取键,为每个键创建一个新的 Divooka.DataAnalytics.DivookaDataColumn,将对应的值添加到该列中,然后将该列包含在 DataGrid 中。
Parameters
| Name | Description | Default |
|---|---|---|
name |
要分配给 DataGrid 的表的名称。 | |
expando |
一个包含键/值对的 System.Dynamic.ExpandoObject,其中每个键代表一列的名称,每个值为该列的初始数据。 |
结果
返回一个新的数据列表实例。
Divooka.DataAnalytics.DivookaDataGrid.#ctor()
使用指定的表名和一组数据列初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例。
Remarks
提供的列将被分配到 DataGrid 的内部列集合中。
Parameters
| Name | Description | Default |
|---|---|---|
name |
要分配给 DataGrid 的表的名称。 | |
columns |
可变数量的 Divooka.DataAnalytics.DivookaDataColumn 对象,这些对象将被包含在 DataGrid 中。 |
结果
返回一个新的数据列表实例。
Divooka.DataAnalytics.DivookaDataGrid.#ctor()
使用 System.Data.DataSet 中的第一个表初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例。
Remarks
该构造函数从提供的 System.Data.DataSet 中检索第一个 System.Data.DataTable,将其表名分配给 DataGrid,并使用
InitializeFromDataTable 方法加载表数据。
Parameters
| Name | Description | Default |
|---|---|---|
dataset |
包含表数据的 System.Data.DataSet。 | |
forceFirstLineAsHeader |
一个布尔值,指示表的第一行是否应被视为表头。默认值为 false。
|
结果
返回一个新的数据列表实例。
Divooka.DataAnalytics.DivookaDataGrid.#ctor()
使用 System.Data.DataTable 初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例。
Remarks
该构造函数通过调用
InitializeFromDataTable 方法(禁用表头处理)从提供的 System.Data.DataTable 中加载网格数据。
Parameters
| Name | Description | Default |
|---|---|---|
dataTable |
用于加载网格数据的 System.Data.DataTable。 |
结果
返回一个新的数据列表实例。
Divooka.DataAnalytics.DivookaDataGrid.#ctor()
从一组值初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例。
Remarks
该构造函数创建一个名为 "Values" 的 Divooka.DataAnalytics.DivookaDataColumn,并从提供的集合中添加每个元素.
当第一个值添加时,该列会自动进行类型检测并设置相应的数据类型.
注意:由于语义上的歧义,该构造函数已被标记为过时。建议使用数据列来初始化网格。
Parameters
| Name | Description | Default |
|---|---|---|
name |
要分配给 DataGrid 的表的名称。 | |
values |
一个 System.Collections.IEnumerable 的值集合(例如 System.Double、System.Int32 或 System.String),这些值将用于创建单一数据列。 |
结果
返回一个新的数据列表实例。
Divooka.DataAnalytics.DivookaDataGrid.LoadFromCSVFile()
将CSV文件读取为 DataGrid。
Parameters
| Name | Description | Default |
|---|---|---|
filePath |
||
containsHeader |
||
invalidValuePolicy |
结果
返回一个新的数据列表实例。
Divooka.DataAnalytics.DivookaDataGrid.LoadFromExcelWorksheet()
从 Excel 文件读取指定工作表并作为 DataGrid;默认使用第一个工作表。
Remarks
如果未来需要扩展 Excel 支持,必须有专门的读取/写入,因为实现可能各不相同。
Parameters
| Name | Description | Default |
|---|---|---|
filePath |
||
worksheet |
||
containsHeader |
||
customRange |
||
invalidValuePolicy |
结果
返回一个新的数据列表实例。
Divooka.DataAnalytics.DivookaDataGrid.PopulateRandomNumbers()
Remarks
TODO: 支持多个列。
Parameters
| Name | Description | Default |
|---|---|---|
count |
||
min |
||
max |
返回生成的随机数列表
Divooka.DataAnalytics.DivookaDataGrid.PopulateRandomIntegers()
Remarks
TODO: 支持多个列。
Parameters
| Name | Description | Default |
|---|---|---|
count |
||
min |
||
max |
返回生成的随机整数列表
Divooka.DataAnalytics.DivookaDataGrid.#ctor()
初始化 Divooka.DataAnalytics.DivookaDataGrid 类的新实例,使用指定的表名称和行。
Remarks
当 firstRowHeaders 为
true 时,rows 的第一行用于初始化列标题,
其余的行被视为数据。
Parameters
| Name | Description | Default |
|---|---|---|
name |
数据列表表的名称。 | |
rows |
行的列表,每行是一个对象列表。如果 firstRowHeaders 为 true,则第一行被解释为列标题。
|
|
firstRowHeaders |
指示 rows 的第一行是否包含列标题。默认值为 true。
|
|
invalidValuePolicy |
添加数据到列时处理无效值类型的策略。 |
返回值
无
Divooka.DataAnalytics.DivookaDataGrid.#ctor()
初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类实例,包含一个列,列中包含字符串值。
Remarks
列的默认名称为 "Array"。
Parameters
| Name | Description | Default |
|---|---|---|
values |
一个可枚举的字符串值集合,用于填充单列。 |
结果
返回一个新的数据列表实例。
Divooka.DataAnalytics.DivookaDataGrid.#ctor()
初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例,该实例具有一个包含整数值的单列。
Remarks
默认情况下,列的名称为“数组”。
Parameters
| Name | Description | Default |
|---|---|---|
values |
一个枚举集合,用于填充单列的整数值。 |
结果
返回一个新的数据列表实例。
Divooka.DataAnalytics.DivookaDataGrid.#ctor()
初始化 Divooka.DataAnalytics.DivookaDataGrid 类的新实例,该实例包含一个列,列中包含双值。
Remarks
列的默认名称为“数组”。
Parameters
| Name | Description | Default |
|---|---|---|
values |
一个可枚举的双值集合,用于填充单列。 |
结果
返回一个新的数据列表实例。
Divooka.DataAnalytics.DivookaDataGrid.TableName
数据列表的名称。
网格名称
返回网格名称字符串。
Divooka.DataAnalytics.DivookaDataGrid.Columns
数据列表的列集合
列集合
返回 DataColumn 列表。
Divooka.DataAnalytics.DivookaDataGrid.OptionalRowHeaderColumn
行的索引/标头
行标头列
返回行标头列。
Divooka.DataAnalytics.DivookaDataGrid.Item()
根据列名获取列;若未找到则返回 null。
null
Parameters
| Name | Description | Default |
|---|---|---|
columnName |
要查询的列的名称。 |
列对象或null
找到则返回列对象,否则返回 null。Divooka.DataAnalytics.DivookaDataColumn
null
Divooka.DataAnalytics.DivookaDataGrid.Item()
根据索引获取列;
Parameters
| Name | Description | Default |
|---|---|---|
columnIndex |
指定要获取的列的索引。 |
列对象
返回指定索引的列对象。Divooka.DataAnalytics.DivookaDataColumn
Divooka.DataAnalytics.DivookaDataGrid.Item()
范围操作。
Parameters
| Name | Description | Default |
|---|---|---|
start |
指定要访问的行的索引。 | |
end |
指定要访问的列的索引。 |
数据切片
根据行列范围返回子集。Divooka.DataAnalytics.DivookaDataGrid
Divooka.DataAnalytics.DivookaDataGrid.ColumnCount
获取列数。
列总数
返回列的数量。
Divooka.DataAnalytics.DivookaDataGrid.ColumnHeaders
获取所有列头。
列头数组
返回列头的数组。
Divooka.DataAnalytics.DivookaDataGrid.HasColumn()
检查给定名称的列是否存在。
Parameters
| Name | Description | Default |
|---|---|---|
name |
存在性
返回是否存在的结果。
Divooka.DataAnalytics.DivookaDataGrid.RowCount
不包含表头行
行总数
返回数据行的数量。
Divooka.DataAnalytics.DivookaDataGrid.Rows
Remarks
当在foreach语句中使用时,可以直接作为IDictionary<string, object>检索,而不是动态类型;也可以转换为ExpandoObject
Divooka.DataAnalytics.DivookaDataGrid.RowValues
Get rows as value objects.
结果
Divooka.DataAnalytics.DivookaDataGrid.SaveToCSVFile()
将 DataGrid 保存为CSV文件
Remarks
此方法将 DataGrid 转换为 CSV 格式并写入指定的文件。
CSV 格式遵循标准约定,包括必要字符的转义。
Parameters
| Name | Description | Default |
|---|---|---|
outputPath |
要保存的CSV文件的完整路径。 |
操作结果
无返回值(文件已保存)。
Divooka.DataAnalytics.DivookaDataGrid.GetDataColumn()
通过其标题名称或索引检索Divooka.DataAnalytics.DivookaDataColumn。
Remarks
如果参数是一个数字字符串,则将其视为列索引。
否则,将其解释为列标题名称。
Parameters
| Name | Description | Default |
|---|---|---|
headerOrIndex |
标题名称或以零为基数的列索引,作为字符串。 |
列对象
返回对应名称的 DataColumn。Divooka.DataAnalytics.DivookaDataColumn
null
Divooka.DataAnalytics.DivookaDataGrid.ToDataTable
Converts the DataGrid into a System.Data.DataTable representation.
Remarks
The method constructs a System.Data.DataTable where each column corresponds to a DataGrid column,
and each row represents a data entry. Column names are processed to avoid invalid characters.
数据表
返回对应的 DataTable 对象。System.Data.DataTable
Divooka.DataAnalytics.DivookaDataGrid.Calculate()
通过对每一行应用函数动态计算新列。
Parameters
| Name | Description | Default |
|---|---|---|
newFieldName |
需要计算的字符串。 | |
computeValue |
处理输入的函数,返回计算结果。 |
结果
返回包含计算结果的新 DataGrid 或修改后的对象。
Divooka.DataAnalytics.DivookaDataGrid.Save()
将当前数据网格作为 CSV 文件保存在指定路径。
Parameters
| Name | Description | Default |
|---|---|---|
path |
指定要保存的文件路径。 |
操作结果
无返回值(将 DataGrid 保存到指定位置)。
Divooka.DataAnalytics.DivookaDataGrid.AddColumn()
向数据列表添加一列。
Parameters
| Name | Description | Default |
|---|---|---|
columnName |
指定列的名称。 |
操作结果
无返回值(列已添加)。Divooka.DataAnalytics.DivookaDataColumn
Divooka.DataAnalytics.DivookaDataGrid.AddColumns()
向数据列表添加列。
Parameters
| Name | Description | Default |
|---|---|---|
columnNames |
要添加的列的名称。 |
操作结果
无返回值(多个列已添加)。Divooka.DataAnalytics.DivookaDataColumn
Divooka.DataAnalytics.DivookaDataGrid.RemoveColumn()
从数据列表中删除列。
Parameters
| Name | Description | Default |
|---|---|---|
extra |
要删除的列的名称。 |
操作结果
无返回值(列已移除)。Divooka.DataAnalytics.DivookaDataColumn
Divooka.DataAnalytics.DivookaDataGrid.AddOptionalRowHeaderColumn()
添加一个可选的行标题列。
Parameters
| Name | Description | Default |
|---|---|---|
columnName |
可选行标题列的名称。 |
操作结果
无返回值(已添加行标头列)。
Divooka.DataAnalytics.DivookaDataGrid.AddColumnFrom()
根据参考列添加一个新列,并指定行数。
Parameters
| Name | Description | Default |
|---|---|---|
refColumn |
参考列。 | |
rowCount |
从参考列复制的行数。 |
操作结果
无返回值(已添加列)。Divooka.DataAnalytics.DivookaDataColumn
Divooka.DataAnalytics.DivookaDataGrid.Sort()
根据指定列的升序或降序排序数据网格。
Parameters
| Name | Description | Default |
|---|---|---|
anchorColumnName |
用作排序键的列名。 | |
reverseOrder |
如果为 true,则按升序排序;如果为 false,则按降序排序。 |
操作结果
无返回值(DataGrid 已排序)。
Divooka.DataAnalytics.DivookaDataGrid.ToDictionary
用于两列数据列表,第一列为名称
字典
返回一个变体的强类型字典类型,例如:Dictionary<string, string>,Dictionary<string, double>等。
Divooka.DataAnalytics.DivookaDataGrid.CovarianceMatrix
结果
返回所有数值列的协方差矩阵。
Divooka.DataAnalytics.DivookaDataGrid.GrowRowBehavior
Specifies the behavior for growing rows in a data grid.
返回增长行为的描述
返回描述了数据网格中行增长行为的行为。
Divooka.DataAnalytics.DivookaDataGrid.GrowRowBehavior.FillZero
新行用零值填充。
Divooka.DataAnalytics.DivookaDataGrid.GrowRowBehavior.CopyAbove
新行通过复制上方行的值来填充。
返回的显示名称
无
Divooka.DataAnalytics.DivookaDataGrid.GrowRowBehavior.LinearInterpolate
新行通过现有值之间的线性插值进行填充。
Divooka.DataAnalytics.DivookaDataGrid.GrowRows()
增加行数并填充某些行
Parameters
| Name | Description | Default |
|---|---|---|
count |
要增加的行数。 | |
growthPattern |
用于填充新行的模式。 |
操作结果
无返回值(行已增加)。
Divooka.DataAnalytics.DivookaDataGrid.Apply()
将转换函数应用于数据网格中的每一行,并返回一个新的 Divooka.DataAnalytics.DivookaDataGrid,其中包含转换后的行。
Remarks
该方法目前将结果物化为一个数组,这可能存在效率问题。
考虑将
ToArray() 替换为 IEnumerable 以提高性能。
Parameters
| Name | Description | Default |
|---|---|---|
transform |
一个接受动态行对象并返回表示转换后行的字典的函数。 |
转换后的数据网格
一个新的 Divooka.DataAnalytics.DivookaDataGrid,其中包含转换后的行。
Divooka.DataAnalytics.DivookaDataGrid.ColumnInfo.NewKey
Gets or sets the processed key name for the column, used for display purposes.
Divooka.DataAnalytics.DivookaDataGrid.ColumnInfo.OriginalHeader
获取或设置数据集中列的原始标题名称。
Divooka.DataAnalytics.DivookaDataGrid.ColumnInfo.ColumnIndex
获取或设置数据集中列的零基索引。
Divooka.DataAnalytics.DivookaDataGrid.ColumnInfo.TypeName
Gets or sets the data type name of the column.
Divooka.DataAnalytics.DivookaDataGrid.GetColumnInfoForDisplay
生成一个字典,将处理后的列名称映射到各自的 Divooka.DataAnalytics.DivookaDataGrid.ColumnInfo 结构。
返回的字典
一个字典,其中键是处理后的列名称(用于显示),值是包含列元数据的 Divooka.DataAnalytics.DivookaDataGrid.ColumnInfo 实例。
Divooka.DataAnalytics.DivookaDataGrid.PreProcessColumnNameForDisplay()
Remarks
TODO: 完全替换此内容,并允许标题被命名为任何内容,并按原样显示。
Parameters
| Name | Description | Default |
|---|---|---|
original |
||
nameCounter |
处理后的列名
Divooka.DataAnalytics.Transformation
DataGrid 的扩展;提供不可变操作
Divooka.DataAnalytics.Transformation.Range()
从原始 DataGrid 中获取指定范围的行。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
原始的数据列表。 | |
start |
||
end |
结果
返回包含所选范围行的新 DataGrid。
Divooka.DataAnalytics.Transformation.Trim()
通过移除开始和结束行来修剪数据网格。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
||
skipStart |
||
skipEnd |
修剪后的数据网格
Divooka.DataAnalytics.Transformation.TakeRows()
类似于“修剪”
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
||
rowCount |
返回的行
返回的行
Divooka.DataAnalytics.Transformation.Rename()
重命名给定 Divooka.DataAnalytics.DivookaDataGrid 中的指定列。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
要修改的数据网格。 | |
originalColumnNames |
要重命名的原始列名数组。 | |
newColumnNames |
新列名数组。 |
重命名后的数据网格
带有重命名列的新 Divooka.DataAnalytics.DivookaDataGrid。
Divooka.DataAnalytics.Transformation.Sort()
根据指定的锚定列对 Divooka.DataAnalytics.DivookaDataGrid 进行排序。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
要排序的数据网格。 | |
anchorColumnName |
用作排序锚定的列名。 | |
reverseOrder |
指示是否按降序(true)或升序(false)排序。 |
排序后的数据网格
按指定列排序的新 Divooka.DataAnalytics.DivookaDataGrid。
Divooka.DataAnalytics.Transformation.Append()
将多个 Divooka.DataAnalytics.DivookaDataGrid 对象附加到单个数据网格中。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrids |
要附加的数据网格数组。 |
组合所有输入数据网格的新数据网格
一个新的 Divooka.DataAnalytics.DivookaDataGrid,它结合了所有输入数据网格。
Divooka.DataAnalytics.Transformation.AddSum()
将一个新列添加到 Divooka.DataAnalytics.DivookaDataGrid,该列包含每个数值列的总和。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
输入数据网格。 |
新数据网格
一个包含额外总和列的新数据网格。
Divooka.DataAnalytics.Transformation.ToVector()
Remarks
另一种实现方法是在 Vector 类里做显式构造函数,但我们更倾向于让 DataGrid 依赖 Vector,而不是反过来。
Parameters
| Name | Description | Default |
|---|---|---|
dataColumn |
要转换的数据列。 |
向量
返回一个表示此列的向量。Divooka.Matrix.DivookaVector
Divooka.DataAnalytics.Transformation.MakeCopy()
创建给定 Divooka.DataAnalytics.DivookaDataGrid 的深拷贝。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
要拷贝的数据网格。 |
新实例
一个新的 Divooka.DataAnalytics.DivookaDataGrid 实例,包含拷贝的数据。
Divooka.DataAnalytics.Transformation.Append()
将另一个 Divooka.DataAnalytics.DivookaDataGrid 的列追加到当前 DataGrid 的副本中。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
基础数据网格。 | |
other |
待追加的数据网格。 |
合并结果
返回将两个 DataGrid 追加后得到的新 DataGrid。Divooka.DataAnalytics.DivookaDataGrid
Divooka.DataAnalytics.Transformation.ExtractColumn()
按名称从Divooka.DataAnalytics.DivookaDataGrid中提取特定列。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
数据网格。 | |
name |
要提取的列的名称。 |
数据列
Divooka.DataAnalytics.Transformation.Extract()
用于提取或重新排序字段
Divooka.DataAnalytics.DivookaDataGrid
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
数据网格。 | |
columnNames |
要提取的列的名称。 |
结果
返回仅包含所需列的新 DataGrid。Divooka.DataAnalytics.DivookaDataGrid
Divooka.DataAnalytics.Transformation.Extract()
通过索引提取 Divooka.DataAnalytics.DivookaDataGrid 的一列。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
数据网格。 | |
index |
要提取的列的索引。 |
结果
返回仅包含指定列的新 DataGrid。Divooka.DataAnalytics.DivookaDataColumn
Divooka.DataAnalytics.Transformation.Extract()
通过索引提取列的向量表示。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
数据网格。 | |
columnIndex |
列的索引。 |
结果
返回仅包含指定列集合的新 DataGrid。Divooka.Matrix.DivookaVector
Divooka.DataAnalytics.Transformation.ExtractVector()
从指定的 Divooka.DataAnalytics.DivookaDataGrid 中按列索引提取一个向量。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
要从中提取向量的数据网格。 | |
index |
要提取的列的零基础索引。 |
向量
返回从指定列创建的向量。Divooka.Matrix.DivookaVector
Divooka.DataAnalytics.Transformation.ExtractVector()
从指定的 Divooka.DataAnalytics.DivookaDataGrid 中按列名提取向量。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
要从中提取向量的数据网格。 | |
name |
要提取的列的名称。 |
向量
返回从指定列创建的向量。Divooka.Matrix.DivookaVector
Divooka.DataAnalytics.Transformation.Exclude()
创建一个新的 Divooka.DataAnalytics.DivookaDataGrid,排除指定的列索引。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
要处理的数据网格。 | |
columnIndex |
要排除的列索引集合。 |
结果
返回排除指定列后的 DataGrid。Divooka.DataAnalytics.DivookaDataGrid
Divooka.DataAnalytics.Transformation.ConvertDateColumnToString()
将 DateTime 或 DateOnly 列转换为带有自定义格式的字符串类型。
常见示例:yyyy-MM-dd HH:mm:ss
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
The data grid. | |
columnName |
The name of the date column to convert. | |
format |
The date format string. |
结果
返回转换完成的新 DataGrid。Divooka.DataAnalytics.DivookaDataGrid
Divooka.DataAnalytics.Transformation.ConvertColumn()
将指定列转换为目标类型,并根据无效数据(缺失或不兼容)处理策略进行处理。
Remarks
如果 invalidValuePolicy 是 Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.Drop,
则会删除具有无效值的行。否则,值将根据提供的策略进行处理。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
要处理的源 Divooka.DataAnalytics.DivookaDataGrid。 | |
columnName |
要转换的列的名称。 | |
targetType |
要将列值转换为的目标 System.Type。 | |
invalidValuePolicy |
在转换过程中处理遇到的无效值的策略。 |
结果
返回转换后的新 DataGrid。Divooka.DataAnalytics.DivookaDataGrid
Divooka.DataAnalytics.Transformation.Exclude()
与 Extract 相反
Divooka.DataAnalytics.DivookaDataGrid
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
The data grid. | |
columnNames |
The names of the columns to exclude. |
结果
返回排除指定列后的 DataGrid。Divooka.DataAnalytics.DivookaDataGrid
Divooka.DataAnalytics.Transformation.FormatColumn()
将数字列格式化为字符串
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
要格式化的 DataGrid。 | |
columnName |
要格式化的列的名称。 | |
numberFormat |
一个字符串格式,其中使用 `{0}` 表示数字。 |
结果
返回格式化后的 DataGrid。
Divooka.DataAnalytics.Transformation.Transpose()
当 DataGrid 不含列头时,转置的行为未定义。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
||
dedicatedHeaderRow |
转置结果
返回转置后的 DataGrid。
Divooka.DataAnalytics.Transformation.Pivot()
对现有表进行透视,使行转换为列。
注意结果列很可能大小不一致!
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
||
groupName |
||
extractColumn |
透视表
返回透视后的新 DataGrid。
Divooka.DataAnalytics.Transformation.Pivot()
对现有表进行透视,使行转换为列。
对缺失值填充 null。
此函数尚未完全实现,聚合函数被忽略。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
要进行透视的数据网格。 | |
indexColumn |
用于指定索引的列名。 | |
groupName |
要用于分组的列名。 | |
extractColumn |
用于提取的数据列名称。 | |
aggregateFunction |
应用于数值聚合的函数。 | |
zeroFill |
对于数值型 NaN,是否使用 0 填充,而不是 null。 |
透视表
返回透视后的新 DataGrid。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics
提供统计相关函数。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.MatrixMultiply()
动态连接序列,可选择是否转置
Remarks
简单矩阵工具;不适用于大量线性代数场景 - 请使用更专业的矩阵库。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrids |
||
shouldTransposes |
结果
返回矩阵相乘后的结果。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.MatrixMultiply()
在两个 DataGrid 之间执行矩阵乘法,仅使用数值列。
Remarks
简单矩阵工具;不适用于大量线性代数场景 - 请使用更专业的矩阵库。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
表示第一个矩阵的左侧数据网格。 | |
other |
表示第二个矩阵的右侧数据网格。 |
结果
返回矩阵相乘后的结果。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Mean()
计算数据列中数值数据的算术平均值。
Parameters
| Name | Description | Default |
|---|---|---|
dataColumn |
包含数值数据的数据列。 |
平均值
返回该列的平均值。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Variance()
计算数据列中数值数据的方差。
Parameters
| Name | Description | Default |
|---|---|---|
dataColumn |
包含数值数据的数据列。 | |
population |
如果为真,则通过(n-1)计算总体方差;否则通过n计算样本方差。 |
方差
返回该列的方差。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.StandardDeviation()
计算DataColumn中数值数据的标准差。
Parameters
| Name | Description | Default |
|---|---|---|
dataColumn |
包含数值数据的DataColumn。 | |
population |
如果为真,则使用总体方差除数(n-1);否则使用样本方差除数(n)。 |
标准差
返回该列的标准差。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Min()
查找 DataColumn 数值数据中的最小值。
Parameters
| Name | Description | Default |
|---|---|---|
dataColumn |
包含数值数据的 DataColumn。 |
最小值
返回该列的最小值。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Max()
查找DataColumn中数值数据的最大值。
Parameters
| Name | Description | Default |
|---|---|---|
dataColumn |
包含数值数据的数据列。 |
最大值
返回该列的最大值。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Sum()
计算DataColumn中数值数据的总和。
Parameters
| Name | Description | Default |
|---|---|---|
dataColumn |
包含数值数据的DataColumn。 |
求和值
返回该列的数值总和。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Correlation()
计算两个数值 DataColumn 之间的相关系数。
Parameters
| Name | Description | Default |
|---|---|---|
dataColumn |
第一个包含数值数据的 DataColumn。 | |
other |
第二个包含数值数据的 DataColumn。 |
相关系数
返回两个列之间的相关系数。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Covariance()
计算两个数值 DataColumn 之间的协方差。
Parameters
| Name | Description | Default |
|---|---|---|
dataColumn |
包含数值数据的第一个 DataColumn。 | |
other |
包含数值数据的第二个 DataColumn。 |
协方差
返回两个列之间的协方差。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Distinct()
获取某个数据列的不同值。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
The DataGrid to operate on. | |
columnName |
The name of the column from which to extract distinct values. | |
values |
Outputs an array of distinct string values found in the specified column. |
唯一值列表
返回去重后的值集合。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.RobustMean()
计算从数组或 DataGrid 中指定列的稳健平均值。
Remarks
我已经不记得这个函数的初衷了。
Parameters
| Name | Description | Default |
|---|---|---|
columnSelection |
GUI 可以基于输入表动态显示此参数,例如当 dataGrid 未连接时可隐藏,并提供列头枚举。 | |
list |
一个双精度数组。在直接从数值计算平均值时使用此参数。 | |
dataGrid |
一个包含数据的 DataGrid,若不使用列表参数时使用。 | |
columnName |
DataGrid 中计算平均值的列名。 | |
resultList |
如果使用,则输出输入列表;否则为 null。 | |
resultDataGrid |
如果使用,则输出输入 DataGrid;否则为 null。 | |
resultValue |
输出计算的平均值。 |
稳健平均值
返回某种稳健性计算得到的平均值。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Range()
输出数值列的最小值、最大值和差值;并在节点消息内容中显示这些数值(共三行)。
Parameters
| Name | Description | Default |
|---|---|---|
message |
用于节点消息的输出 | |
dataGrid |
The DataGrid containing the column. | |
columnName |
The name of the column to analyze. | |
min |
Outputs the minimum value in the column. | |
max |
Outputs the maximum value in the column. | |
range |
Outputs the difference between the maximum and minimum values. |
范围信息
返回最小值、最大值、跨度等信息。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Mean()
获取指定数值列的平均值。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
The DataGrid containing the column. | |
columnName |
The name of the column to compute the mean. |
平均值
返回该列的平均值。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Variance()
获取指定数值列的方差。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
包含该列的数据网格。 | |
columnName |
要计算方差的列的名称。 |
方差
返回该列的方差。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.StandardDeviation()
获取指定数值列的标准差。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
包含该列的数据网格。 | |
columnName |
计算标准差的列名称。 |
标准差
返回该列的标准差。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Min()
获取指定数值列的最小值。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
The DataGrid containing the column. | |
columnName |
The name of the column to analyze. |
最小值
返回该列的最小值。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Max()
获取指定数值列的最大值。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
包含该列的数据网格。 | |
columnName |
要分析的列的名称。 |
最大值
返回该列的最大值。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Sum()
计算数据网格中指定列的数值总和。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
包含所需列的数据网格。 | |
columnName |
需要进行求和的列的名称。 |
总和
返回指定数值列的总和。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Correlation()
计算基于指定数值列的两个 DataGrid 之间的相关系数。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid1 |
包含列的第一个 DataGrid。 | |
dataGrid2 |
包含列的第二个 DataGrid。 | |
columnName1 |
第一个 DataGrid 中列的名称。 | |
columnName2 |
第二个 DataGrid 中列的名称。 |
相关系数
返回两个指定列之间的相关系数。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Covariance()
计算基于指定数值列的两个DataGrid之间的协方差。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid1 |
包含该列的第一个DataGrid。 | |
dataGrid2 |
包含该列的第二个DataGrid。 | |
columnName1 |
第一个DataGrid中列的名称。 | |
columnName2 |
第二个DataGrid中列的名称。 |
协方差
返回两个指定列之间的协方差。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.CovarianceMatrix()
计算数据列表的数值列的协方差矩阵。
Remarks
TODO: 冗余,彻底删除此函数 - 或者更新数据列表接口以在此处实现协方差矩阵
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
要分析的数据列表。 |
协方差矩阵数据列表
表示协方差矩阵的数据列表。
Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.PercentReturn()
计算 DataGrid 中每个数值列的百分比收益率。
Parameters
| Name | Description | Default |
|---|---|---|
dataGrid |
包含财务数据的数据网格。 | |
LatestAtTop |
确定最新数据是否位于列的顶部。如果为真,则从顶部开始返回计算值。 |
结果
返回包含百分比收益率的新 DataGrid。
Divooka.DataAnalytics.DivookaDataGridOperations.Preprocessing.Clean()
清洗传入的 DataGrid,报告坏行,并保留好的行。
清洗结果
无返回值(通过引用返回坏行与好行)。
Divooka.DataAnalytics.DataTableExtensions.PrintFormat()
以适合控制台/ASCII 显示的格式输出
格式化字符串
返回格式化后的文本。
Divooka.DataAnalytics.DataTableExtensions.Unwrap``1()
从 DataTable 中通过反射检索目标类型的对象列表;
目标类型必须具有公共属性;属性名不区分大小写
对象列表
返回目标类型的对象列表。
Divooka.DataAnalytics.DataTableExtensions.Single``1()
从单个单元格中获取指定类型的值;
如果无效则抛出异常
单个值
返回目标类型的单个值。
Divooka.DataAnalytics.DataTableExtensions.List``1()
从 DataTable 中提取某列的一组值
值列表
返回一个包含单一类型的值列表。