Divooka.DataAnalytics.zh

Divooka.DataAnalytics.ConversionHelpers.GetExcelColumnName()

获取列名(以字母表示)。

Parameters

NameDescriptionDefault
columnNumber 假设列 A 对应列号 1
zeroIndexed 指示输入列索引是否为零基础。

列名

返回列名字符串。

Divooka.DataAnalytics.ConversionHelpers.GetExcelColumnIndex()

将Excel样式的列名称(例如,“A”,“B”,“AA”)转换为相应的列索引。

Parameters

NameDescriptionDefault
columnName 要转换的列名称。
zeroIndexed 指示输出索引是否应为零基础。

列索引

相应的列索引(基于1或基于0,具体取决于zeroIndexed参数)。

Divooka.DataAnalytics.ConversionHelpers.ParseExcelCellCoordinate()

解析Excel样式的单元格引用(例如,“A1”,“BC12”)为其数字行和列索引。

Parameters

NameDescriptionDefault
cell 单元格引用字符串。
zeroIndexed 指示输出的行和列索引是否应为零基础。

包含解析的行和列索引的元组

包含解析的行和列索引的元组。

Divooka.DataAnalytics.DivookaDataColumn.InvalidValueTypeHandlingPolicy.ThrowException

抛出异常

Divooka.DataAnalytics.DivookaDataColumn.InvalidValueTypeHandlingPolicy.DBNullify

将该值设置为 DBNull

Divooka.DataAnalytics.DivookaDataColumn.InvalidValueTypeHandlingPolicy.Keep

保留新值而不修改列类型

Divooka.DataAnalytics.DivookaDataColumn.InvalidValueTypeHandlingPolicy.InitializeDefault

使用列类型初始化默认值

Divooka.DataAnalytics.DivookaDataColumn.InvalidValueTypeHandlingPolicy.ChangeColumnToMixedType

将列类型改为 object

Divooka.DataAnalytics.DivookaDataColumn.InvalidValueTypeHandlingPolicy.ChangeColumnToStringType

改变并转换现有值和列类型为 string

Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy

Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.ThrowException

抛出异常

Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.DBNullify

将该值设置为 DBNull

Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.Keep

保留新值而不修改列类型

Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.InitializeDefault

使用列类型初始化默认值

Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.ChangeColumnToMixedType

将列类型改为 object

Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.ChangeColumnToStringType

改变并转换现有值及列类型为 string

Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.Drop

Remarks

必须由调用者间接处理。

Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.ForwardFill

使用之前的有效单元格值填充。

Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.BackwardFill

使用之后的有效单元格值填充。

Divooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.LinearlyInterpolate

对数值进行线性插值,填充空缺。

Remarks

可能更适合作为针对特定列类型的预处理操作。

Divooka.DataAnalytics.DivookaDataColumn.Add``1()

Remarks

列类型由第一个添加的元素决定。

Divooka.DataAnalytics.DivookaDataColumn.TryGetDataAs()

尝试将数据转换为目标类型,可选地指定无效值处理策略。

转换结果

返回转换后的数据或相应的处理结果。

Divooka.DataAnalytics.DivookaDataColumn.Distinct()

获取不同的值作为字符串;如果列包含空值,可以选择忽略空值。 将空表示为 "<NULL>"。

Parameters

NameDescriptionDefault
ignoreNull 是否忽略空值

返回字符串值列表

返回一个字符串值的列表

Divooka.DataAnalytics.DivookaDataGrid

一个面向程序员/纯C#/Parcel的表格数据API,具有多种灵活功能。 面向对象:行为对象,列是对象的属性。标头因此是这些属性的名称。某些函数内置了这些假设以实现优化。 请注意列名可以是任何内容,这可能会影响后续显示和处理(例如传入SQL时重复的列名会有问题,或在WPF中直接显示时列名包含 / 会无法正确绑定)。

Remarks

通常情况下,对于较小的返回结果,我们更偏向使用数组而不是 IEnumerable,因为这避免了在调用端多调用一次函数(例如 ToArray)。 TODO: 与 Parcel.Math.Types.Vector 类型进行合并 TODO: 使此类型完全不可变。

Divooka.DataAnalytics.DivookaDataGrid.Preformatting()

自动将字符串解析为可能的强类型对象

Parameters

NameDescriptionDefault
inputValue

预处理结果

返回处理后的 DataGrid(内部修改或新对象)。

Divooka.DataAnalytics.DivookaDataGrid.#ctor

初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例。

Remarks

此默认构造函数创建一个空的 DataGrid,其使用默认设置。

结果

返回一个新的数据列表实例。

Divooka.DataAnalytics.DivookaDataGrid.#ctor()

使用指定的表名和来自 System.Dynamic.ExpandoObject 的数据初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例。

Remarks

该构造函数从提供的 System.Dynamic.ExpandoObject 中提取键,为每个键创建一个新的 Divooka.DataAnalytics.DivookaDataColumn,将对应的值添加到该列中,然后将该列包含在 DataGrid 中。

Parameters

NameDescriptionDefault
name 要分配给 DataGrid 的表的名称。
expando 一个包含键/值对的 System.Dynamic.ExpandoObject,其中每个键代表一列的名称,每个值为该列的初始数据。

结果

返回一个新的数据列表实例。

Divooka.DataAnalytics.DivookaDataGrid.#ctor()

使用指定的表名和一组数据列初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例。

Remarks

提供的列将被分配到 DataGrid 的内部列集合中。

Parameters

NameDescriptionDefault
name 要分配给 DataGrid 的表的名称。
columns 可变数量的 Divooka.DataAnalytics.DivookaDataColumn 对象,这些对象将被包含在 DataGrid 中。

结果

返回一个新的数据列表实例。

Divooka.DataAnalytics.DivookaDataGrid.#ctor()

使用 System.Data.DataSet 中的第一个表初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例。

Remarks

该构造函数从提供的 System.Data.DataSet 中检索第一个 System.Data.DataTable,将其表名分配给 DataGrid,并使用 InitializeFromDataTable 方法加载表数据。

Parameters

NameDescriptionDefault
dataset 包含表数据的 System.Data.DataSet
forceFirstLineAsHeader 一个布尔值,指示表的第一行是否应被视为表头。默认值为 false

结果

返回一个新的数据列表实例。

Divooka.DataAnalytics.DivookaDataGrid.#ctor()

使用 System.Data.DataTable 初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例。

Remarks

该构造函数通过调用 InitializeFromDataTable 方法(禁用表头处理)从提供的 System.Data.DataTable 中加载网格数据。

Parameters

NameDescriptionDefault
dataTable 用于加载网格数据的 System.Data.DataTable

结果

返回一个新的数据列表实例。

Divooka.DataAnalytics.DivookaDataGrid.#ctor()

从一组值初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例。

Remarks

该构造函数创建一个名为 "Values" 的 Divooka.DataAnalytics.DivookaDataColumn,并从提供的集合中添加每个元素. 当第一个值添加时,该列会自动进行类型检测并设置相应的数据类型.

注意:由于语义上的歧义,该构造函数已被标记为过时。建议使用数据列来初始化网格。

Parameters

NameDescriptionDefault
name 要分配给 DataGrid 的表的名称。
values 一个 System.Collections.IEnumerable 的值集合(例如 System.DoubleSystem.Int32System.String),这些值将用于创建单一数据列。

结果

返回一个新的数据列表实例。

Divooka.DataAnalytics.DivookaDataGrid.LoadFromCSVFile()

将CSV文件读取为 DataGrid。

Parameters

NameDescriptionDefault
filePath
containsHeader
invalidValuePolicy

结果

返回一个新的数据列表实例。

Divooka.DataAnalytics.DivookaDataGrid.LoadFromExcelWorksheet()

从 Excel 文件读取指定工作表并作为 DataGrid;默认使用第一个工作表。

Remarks

如果未来需要扩展 Excel 支持,必须有专门的读取/写入,因为实现可能各不相同。

Parameters

NameDescriptionDefault
filePath
worksheet
containsHeader
customRange
invalidValuePolicy

结果

返回一个新的数据列表实例。

Divooka.DataAnalytics.DivookaDataGrid.PopulateRandomNumbers()

Remarks

TODO: 支持多个列。

Parameters

NameDescriptionDefault
count
min
max

返回生成的随机数列表

Divooka.DataAnalytics.DivookaDataGrid.PopulateRandomIntegers()

Remarks

TODO: 支持多个列。

Parameters

NameDescriptionDefault
count
min
max

返回生成的随机整数列表

Divooka.DataAnalytics.DivookaDataGrid.#ctor()

初始化 Divooka.DataAnalytics.DivookaDataGrid 类的新实例,使用指定的表名称和行。

Remarks

firstRowHeaderstrue 时,rows 的第一行用于初始化列标题, 其余的行被视为数据。

Parameters

NameDescriptionDefault
name 数据列表表的名称。
rows 行的列表,每行是一个对象列表。如果 firstRowHeaderstrue,则第一行被解释为列标题。
firstRowHeaders 指示 rows 的第一行是否包含列标题。默认值为 true
invalidValuePolicy 添加数据到列时处理无效值类型的策略。

返回值

Divooka.DataAnalytics.DivookaDataGrid.#ctor()

初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类实例,包含一个列,列中包含字符串值。

Remarks

列的默认名称为 "Array"。

Parameters

NameDescriptionDefault
values 一个可枚举的字符串值集合,用于填充单列。

结果

返回一个新的数据列表实例。

Divooka.DataAnalytics.DivookaDataGrid.#ctor()

初始化一个新的 Divooka.DataAnalytics.DivookaDataGrid 类的实例,该实例具有一个包含整数值的单列。

Remarks

默认情况下,列的名称为“数组”。

Parameters

NameDescriptionDefault
values 一个枚举集合,用于填充单列的整数值。

结果

返回一个新的数据列表实例。

Divooka.DataAnalytics.DivookaDataGrid.#ctor()

初始化 Divooka.DataAnalytics.DivookaDataGrid 类的新实例,该实例包含一个列,列中包含双值。

Remarks

列的默认名称为“数组”。

Parameters

NameDescriptionDefault
values 一个可枚举的双值集合,用于填充单列。

结果

返回一个新的数据列表实例。

Divooka.DataAnalytics.DivookaDataGrid.TableName

数据列表的名称。

网格名称

返回网格名称字符串。

Divooka.DataAnalytics.DivookaDataGrid.Columns

数据列表的列集合

列集合

返回 DataColumn 列表。

Divooka.DataAnalytics.DivookaDataGrid.OptionalRowHeaderColumn

行的索引/标头

行标头列

返回行标头列。

Divooka.DataAnalytics.DivookaDataGrid.Item()

根据列名获取列;若未找到则返回 null。 null

Parameters

NameDescriptionDefault
columnName 要查询的列的名称。

列对象或null

找到则返回列对象,否则返回 null。Divooka.DataAnalytics.DivookaDataColumnnull

Divooka.DataAnalytics.DivookaDataGrid.Item()

根据索引获取列;

Parameters

NameDescriptionDefault
columnIndex 指定要获取的列的索引。

列对象

返回指定索引的列对象。Divooka.DataAnalytics.DivookaDataColumn

Divooka.DataAnalytics.DivookaDataGrid.Item()

范围操作。

Parameters

NameDescriptionDefault
start 指定要访问的行的索引。
end 指定要访问的列的索引。

数据切片

根据行列范围返回子集。Divooka.DataAnalytics.DivookaDataGrid

Divooka.DataAnalytics.DivookaDataGrid.ColumnCount

获取列数。

列总数

返回列的数量。

Divooka.DataAnalytics.DivookaDataGrid.ColumnHeaders

获取所有列头。

列头数组

返回列头的数组。

Divooka.DataAnalytics.DivookaDataGrid.HasColumn()

检查给定名称的列是否存在。

Parameters

NameDescriptionDefault
name

存在性

返回是否存在的结果。

Divooka.DataAnalytics.DivookaDataGrid.RowCount

不包含表头行

行总数

返回数据行的数量。

Divooka.DataAnalytics.DivookaDataGrid.Rows

Remarks

当在foreach语句中使用时,可以直接作为IDictionary<string, object>检索,而不是动态类型;也可以转换为ExpandoObject

Divooka.DataAnalytics.DivookaDataGrid.RowValues

Get rows as value objects.

结果

Divooka.DataAnalytics.DivookaDataGrid.SaveToCSVFile()

将 DataGrid 保存为CSV文件

Remarks

此方法将 DataGrid 转换为 CSV 格式并写入指定的文件。 CSV 格式遵循标准约定,包括必要字符的转义。

Parameters

NameDescriptionDefault
outputPath 要保存的CSV文件的完整路径。

操作结果

无返回值(文件已保存)。

Divooka.DataAnalytics.DivookaDataGrid.GetDataColumn()

通过其标题名称或索引检索Divooka.DataAnalytics.DivookaDataColumn

Remarks

如果参数是一个数字字符串,则将其视为列索引。 否则,将其解释为列标题名称。

Parameters

NameDescriptionDefault
headerOrIndex 标题名称或以零为基数的列索引,作为字符串。

列对象

返回对应名称的 DataColumn。Divooka.DataAnalytics.DivookaDataColumnnull

Divooka.DataAnalytics.DivookaDataGrid.ToDataTable

Converts the DataGrid into a System.Data.DataTable representation.

Remarks

The method constructs a System.Data.DataTable where each column corresponds to a DataGrid column, and each row represents a data entry. Column names are processed to avoid invalid characters.

数据表

返回对应的 DataTable 对象。System.Data.DataTable

Divooka.DataAnalytics.DivookaDataGrid.Calculate()

通过对每一行应用函数动态计算新列。

Parameters

NameDescriptionDefault
newFieldName 需要计算的字符串。
computeValue 处理输入的函数,返回计算结果。

结果

返回包含计算结果的新 DataGrid 或修改后的对象。

Divooka.DataAnalytics.DivookaDataGrid.Save()

将当前数据网格作为 CSV 文件保存在指定路径。

Parameters

NameDescriptionDefault
path 指定要保存的文件路径。

操作结果

无返回值(将 DataGrid 保存到指定位置)。

Divooka.DataAnalytics.DivookaDataGrid.AddColumn()

向数据列表添加一列。

Parameters

NameDescriptionDefault
columnName 指定列的名称。

操作结果

无返回值(列已添加)。Divooka.DataAnalytics.DivookaDataColumn

Divooka.DataAnalytics.DivookaDataGrid.AddColumns()

向数据列表添加列。

Parameters

NameDescriptionDefault
columnNames 要添加的列的名称。

操作结果

无返回值(多个列已添加)。Divooka.DataAnalytics.DivookaDataColumn

Divooka.DataAnalytics.DivookaDataGrid.RemoveColumn()

从数据列表中删除列。

Parameters

NameDescriptionDefault
extra 要删除的列的名称。

操作结果

无返回值(列已移除)。Divooka.DataAnalytics.DivookaDataColumn

Divooka.DataAnalytics.DivookaDataGrid.AddOptionalRowHeaderColumn()

添加一个可选的行标题列。

Parameters

NameDescriptionDefault
columnName 可选行标题列的名称。

操作结果

无返回值(已添加行标头列)。

Divooka.DataAnalytics.DivookaDataGrid.AddColumnFrom()

根据参考列添加一个新列,并指定行数。

Parameters

NameDescriptionDefault
refColumn 参考列。
rowCount 从参考列复制的行数。

操作结果

无返回值(已添加列)。Divooka.DataAnalytics.DivookaDataColumn

Divooka.DataAnalytics.DivookaDataGrid.Sort()

根据指定列的升序或降序排序数据网格。

Parameters

NameDescriptionDefault
anchorColumnName 用作排序键的列名。
reverseOrder 如果为 true,则按升序排序;如果为 false,则按降序排序。

操作结果

无返回值(DataGrid 已排序)。

Divooka.DataAnalytics.DivookaDataGrid.ToDictionary

用于两列数据列表,第一列为名称

字典

返回一个变体的强类型字典类型,例如:Dictionary<string, string>,Dictionary<string, double>等。

Divooka.DataAnalytics.DivookaDataGrid.CovarianceMatrix

结果

返回所有数值列的协方差矩阵。

Divooka.DataAnalytics.DivookaDataGrid.GrowRowBehavior

Specifies the behavior for growing rows in a data grid.

返回增长行为的描述

返回描述了数据网格中行增长行为的行为。

Divooka.DataAnalytics.DivookaDataGrid.GrowRowBehavior.FillZero

新行用零值填充。

Divooka.DataAnalytics.DivookaDataGrid.GrowRowBehavior.CopyAbove

新行通过复制上方行的值来填充。

返回的显示名称

Divooka.DataAnalytics.DivookaDataGrid.GrowRowBehavior.LinearInterpolate

新行通过现有值之间的线性插值进行填充。

Divooka.DataAnalytics.DivookaDataGrid.GrowRows()

增加行数并填充某些行

Parameters

NameDescriptionDefault
count 要增加的行数。
growthPattern 用于填充新行的模式。

操作结果

无返回值(行已增加)。

Divooka.DataAnalytics.DivookaDataGrid.Apply()

将转换函数应用于数据网格中的每一行,并返回一个新的 Divooka.DataAnalytics.DivookaDataGrid,其中包含转换后的行。

Remarks

该方法目前将结果物化为一个数组,这可能存在效率问题。 考虑将 ToArray() 替换为 IEnumerable 以提高性能。

Parameters

NameDescriptionDefault
transform 一个接受动态行对象并返回表示转换后行的字典的函数。

转换后的数据网格

一个新的 Divooka.DataAnalytics.DivookaDataGrid,其中包含转换后的行。

Divooka.DataAnalytics.DivookaDataGrid.ColumnInfo.NewKey

Gets or sets the processed key name for the column, used for display purposes.

Divooka.DataAnalytics.DivookaDataGrid.ColumnInfo.OriginalHeader

获取或设置数据集中列的原始标题名称。

Divooka.DataAnalytics.DivookaDataGrid.ColumnInfo.ColumnIndex

获取或设置数据集中列的零基索引。

Divooka.DataAnalytics.DivookaDataGrid.ColumnInfo.TypeName

Gets or sets the data type name of the column.

Divooka.DataAnalytics.DivookaDataGrid.GetColumnInfoForDisplay

生成一个字典,将处理后的列名称映射到各自的 Divooka.DataAnalytics.DivookaDataGrid.ColumnInfo 结构。

返回的字典

一个字典,其中键是处理后的列名称(用于显示),值是包含列元数据的 Divooka.DataAnalytics.DivookaDataGrid.ColumnInfo 实例。

Divooka.DataAnalytics.DivookaDataGrid.PreProcessColumnNameForDisplay()

Remarks

TODO: 完全替换此内容,并允许标题被命名为任何内容,并按原样显示。

Parameters

NameDescriptionDefault
original
nameCounter

处理后的列名

Divooka.DataAnalytics.Transformation

DataGrid 的扩展;提供不可变操作

Divooka.DataAnalytics.Transformation.Range()

从原始 DataGrid 中获取指定范围的行。

Parameters

NameDescriptionDefault
dataGrid 原始的数据列表。
start
end

结果

返回包含所选范围行的新 DataGrid。

Divooka.DataAnalytics.Transformation.Trim()

通过移除开始和结束行来修剪数据网格。

Parameters

NameDescriptionDefault
dataGrid
skipStart
skipEnd

修剪后的数据网格

Divooka.DataAnalytics.Transformation.TakeRows()

类似于“修剪”

Parameters

NameDescriptionDefault
dataGrid
rowCount

返回的行

返回的行

Divooka.DataAnalytics.Transformation.Rename()

重命名给定 Divooka.DataAnalytics.DivookaDataGrid 中的指定列。

Parameters

NameDescriptionDefault
dataGrid 要修改的数据网格。
originalColumnNames 要重命名的原始列名数组。
newColumnNames 新列名数组。

重命名后的数据网格

带有重命名列的新 Divooka.DataAnalytics.DivookaDataGrid

Divooka.DataAnalytics.Transformation.Sort()

根据指定的锚定列对 Divooka.DataAnalytics.DivookaDataGrid 进行排序。

Parameters

NameDescriptionDefault
dataGrid 要排序的数据网格。
anchorColumnName 用作排序锚定的列名。
reverseOrder 指示是否按降序(true)或升序(false)排序。

排序后的数据网格

按指定列排序的新 Divooka.DataAnalytics.DivookaDataGrid

Divooka.DataAnalytics.Transformation.Append()

将多个 Divooka.DataAnalytics.DivookaDataGrid 对象附加到单个数据网格中。

Parameters

NameDescriptionDefault
dataGrids 要附加的数据网格数组。

组合所有输入数据网格的新数据网格

一个新的 Divooka.DataAnalytics.DivookaDataGrid,它结合了所有输入数据网格。

Divooka.DataAnalytics.Transformation.AddSum()

将一个新列添加到 Divooka.DataAnalytics.DivookaDataGrid,该列包含每个数值列的总和。

Parameters

NameDescriptionDefault
dataGrid 输入数据网格。

新数据网格

一个包含额外总和列的新数据网格。

Divooka.DataAnalytics.Transformation.ToVector()

Remarks

另一种实现方法是在 Vector 类里做显式构造函数,但我们更倾向于让 DataGrid 依赖 Vector,而不是反过来。

Parameters

NameDescriptionDefault
dataColumn 要转换的数据列。

向量

返回一个表示此列的向量。Divooka.Matrix.DivookaVector

Divooka.DataAnalytics.Transformation.MakeCopy()

创建给定 Divooka.DataAnalytics.DivookaDataGrid 的深拷贝。

Parameters

NameDescriptionDefault
dataGrid 要拷贝的数据网格。

新实例

一个新的 Divooka.DataAnalytics.DivookaDataGrid 实例,包含拷贝的数据。

Divooka.DataAnalytics.Transformation.Append()

将另一个 Divooka.DataAnalytics.DivookaDataGrid 的列追加到当前 DataGrid 的副本中。

Parameters

NameDescriptionDefault
dataGrid 基础数据网格。
other 待追加的数据网格。

合并结果

返回将两个 DataGrid 追加后得到的新 DataGrid。Divooka.DataAnalytics.DivookaDataGrid

Divooka.DataAnalytics.Transformation.ExtractColumn()

按名称从Divooka.DataAnalytics.DivookaDataGrid中提取特定列。

Parameters

NameDescriptionDefault
dataGrid 数据网格。
name 要提取的列的名称。

数据列

返回提取到的列。Divooka.DataAnalytics.DivookaDataColumn

Divooka.DataAnalytics.Transformation.Extract()

用于提取或重新排序字段 Divooka.DataAnalytics.DivookaDataGrid

Parameters

NameDescriptionDefault
dataGrid 数据网格。
columnNames 要提取的列的名称。

结果

返回仅包含所需列的新 DataGrid。Divooka.DataAnalytics.DivookaDataGrid

Divooka.DataAnalytics.Transformation.Extract()

通过索引提取 Divooka.DataAnalytics.DivookaDataGrid 的一列。

Parameters

NameDescriptionDefault
dataGrid 数据网格。
index 要提取的列的索引。

结果

返回仅包含指定列的新 DataGrid。Divooka.DataAnalytics.DivookaDataColumn

Divooka.DataAnalytics.Transformation.Extract()

通过索引提取列的向量表示。

Parameters

NameDescriptionDefault
dataGrid 数据网格。
columnIndex 列的索引。

结果

返回仅包含指定列集合的新 DataGrid。Divooka.Matrix.DivookaVector

Divooka.DataAnalytics.Transformation.ExtractVector()

从指定的 Divooka.DataAnalytics.DivookaDataGrid 中按列索引提取一个向量。

Parameters

NameDescriptionDefault
dataGrid 要从中提取向量的数据网格。
index 要提取的列的零基础索引。

向量

返回从指定列创建的向量。Divooka.Matrix.DivookaVector

Divooka.DataAnalytics.Transformation.ExtractVector()

从指定的 Divooka.DataAnalytics.DivookaDataGrid 中按列名提取向量。

Parameters

NameDescriptionDefault
dataGrid 要从中提取向量的数据网格。
name 要提取的列的名称。

向量

返回从指定列创建的向量。Divooka.Matrix.DivookaVector

Divooka.DataAnalytics.Transformation.Exclude()

创建一个新的 Divooka.DataAnalytics.DivookaDataGrid,排除指定的列索引。

Parameters

NameDescriptionDefault
dataGrid 要处理的数据网格。
columnIndex 要排除的列索引集合。

结果

返回排除指定列后的 DataGrid。Divooka.DataAnalytics.DivookaDataGrid

Divooka.DataAnalytics.Transformation.ConvertDateColumnToString()

将 DateTime 或 DateOnly 列转换为带有自定义格式的字符串类型。 常见示例:yyyy-MM-dd HH:mm:ss

Parameters

NameDescriptionDefault
dataGrid The data grid.
columnName The name of the date column to convert.
format The date format string.

结果

返回转换完成的新 DataGrid。Divooka.DataAnalytics.DivookaDataGrid

Divooka.DataAnalytics.Transformation.ConvertColumn()

将指定列转换为目标类型,并根据无效数据(缺失或不兼容)处理策略进行处理。

Remarks

如果 invalidValuePolicyDivooka.DataAnalytics.DivookaDataColumn.AdvancedInvalidValueTypeHandlingPolicy.Drop, 则会删除具有无效值的行。否则,值将根据提供的策略进行处理。

Parameters

NameDescriptionDefault
dataGrid 要处理的源 Divooka.DataAnalytics.DivookaDataGrid
columnName 要转换的列的名称。
targetType 要将列值转换为的目标 System.Type
invalidValuePolicy 在转换过程中处理遇到的无效值的策略。

结果

返回转换后的新 DataGrid。Divooka.DataAnalytics.DivookaDataGrid

Divooka.DataAnalytics.Transformation.Exclude()

Parameters

NameDescriptionDefault
dataGrid The data grid.
columnNames The names of the columns to exclude.

结果

返回排除指定列后的 DataGrid。Divooka.DataAnalytics.DivookaDataGrid

Divooka.DataAnalytics.Transformation.FormatColumn()

将数字列格式化为字符串

Parameters

NameDescriptionDefault
dataGrid 要格式化的 DataGrid。
columnName 要格式化的列的名称。
numberFormat 一个字符串格式,其中使用 `{0}` 表示数字。

结果

返回格式化后的 DataGrid。

Divooka.DataAnalytics.Transformation.Transpose()

当 DataGrid 不含列头时,转置的行为未定义。

Parameters

NameDescriptionDefault
dataGrid
dedicatedHeaderRow

转置结果

返回转置后的 DataGrid。

Divooka.DataAnalytics.Transformation.Pivot()

对现有表进行透视,使行转换为列。 注意结果列很可能大小不一致!

Parameters

NameDescriptionDefault
dataGrid
groupName
extractColumn

透视表

返回透视后的新 DataGrid。

Divooka.DataAnalytics.Transformation.Pivot()

对现有表进行透视,使行转换为列。 对缺失值填充 null。 此函数尚未完全实现,聚合函数被忽略。

Parameters

NameDescriptionDefault
dataGrid 要进行透视的数据网格。
indexColumn 用于指定索引的列名。
groupName 要用于分组的列名。
extractColumn 用于提取的数据列名称。
aggregateFunction 应用于数值聚合的函数。
zeroFill 对于数值型 NaN,是否使用 0 填充,而不是 null。

透视表

返回透视后的新 DataGrid。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics

提供统计相关函数。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.MatrixMultiply()

动态连接序列,可选择是否转置

Remarks

简单矩阵工具;不适用于大量线性代数场景 - 请使用更专业的矩阵库。

Parameters

NameDescriptionDefault
dataGrids
shouldTransposes

结果

返回矩阵相乘后的结果。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.MatrixMultiply()

在两个 DataGrid 之间执行矩阵乘法,仅使用数值列。

Remarks

简单矩阵工具;不适用于大量线性代数场景 - 请使用更专业的矩阵库。

Parameters

NameDescriptionDefault
dataGrid 表示第一个矩阵的左侧数据网格。
other 表示第二个矩阵的右侧数据网格。

结果

返回矩阵相乘后的结果。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Mean()

计算数据列中数值数据的算术平均值。

Parameters

NameDescriptionDefault
dataColumn 包含数值数据的数据列。

平均值

返回该列的平均值。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Variance()

计算数据列中数值数据的方差。

Parameters

NameDescriptionDefault
dataColumn 包含数值数据的数据列。
population 如果为真,则通过(n-1)计算总体方差;否则通过n计算样本方差。

方差

返回该列的方差。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.StandardDeviation()

计算DataColumn中数值数据的标准差。

Parameters

NameDescriptionDefault
dataColumn 包含数值数据的DataColumn。
population 如果为真,则使用总体方差除数(n-1);否则使用样本方差除数(n)。

标准差

返回该列的标准差。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Min()

查找 DataColumn 数值数据中的最小值。

Parameters

NameDescriptionDefault
dataColumn 包含数值数据的 DataColumn。

最小值

返回该列的最小值。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Max()

查找DataColumn中数值数据的最大值。

Parameters

NameDescriptionDefault
dataColumn 包含数值数据的数据列。

最大值

返回该列的最大值。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Sum()

计算DataColumn中数值数据的总和。

Parameters

NameDescriptionDefault
dataColumn 包含数值数据的DataColumn。

求和值

返回该列的数值总和。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Correlation()

计算两个数值 DataColumn 之间的相关系数。

Parameters

NameDescriptionDefault
dataColumn 第一个包含数值数据的 DataColumn。
other 第二个包含数值数据的 DataColumn。

相关系数

返回两个列之间的相关系数。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Covariance()

计算两个数值 DataColumn 之间的协方差。

Parameters

NameDescriptionDefault
dataColumn 包含数值数据的第一个 DataColumn。
other 包含数值数据的第二个 DataColumn。

协方差

返回两个列之间的协方差。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Distinct()

获取某个数据列的不同值。

Parameters

NameDescriptionDefault
dataGrid The DataGrid to operate on.
columnName The name of the column from which to extract distinct values.
values Outputs an array of distinct string values found in the specified column.

唯一值列表

返回去重后的值集合。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.RobustMean()

计算从数组或 DataGrid 中指定列的稳健平均值。

Remarks

我已经不记得这个函数的初衷了。

Parameters

NameDescriptionDefault
columnSelection GUI 可以基于输入表动态显示此参数,例如当 dataGrid 未连接时可隐藏,并提供列头枚举。
list 一个双精度数组。在直接从数值计算平均值时使用此参数。
dataGrid 一个包含数据的 DataGrid,若不使用列表参数时使用。
columnName DataGrid 中计算平均值的列名。
resultList 如果使用,则输出输入列表;否则为 null。
resultDataGrid 如果使用,则输出输入 DataGrid;否则为 null。
resultValue 输出计算的平均值。

稳健平均值

返回某种稳健性计算得到的平均值。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Range()

输出数值列的最小值、最大值和差值;并在节点消息内容中显示这些数值(共三行)。

Parameters

NameDescriptionDefault
message 用于节点消息的输出
dataGrid The DataGrid containing the column.
columnName The name of the column to analyze.
min Outputs the minimum value in the column.
max Outputs the maximum value in the column.
range Outputs the difference between the maximum and minimum values.

范围信息

返回最小值、最大值、跨度等信息。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Mean()

获取指定数值列的平均值。

Parameters

NameDescriptionDefault
dataGrid The DataGrid containing the column.
columnName The name of the column to compute the mean.

平均值

返回该列的平均值。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Variance()

获取指定数值列的方差。

Parameters

NameDescriptionDefault
dataGrid 包含该列的数据网格。
columnName 要计算方差的列的名称。

方差

返回该列的方差。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.StandardDeviation()

获取指定数值列的标准差。

Parameters

NameDescriptionDefault
dataGrid 包含该列的数据网格。
columnName 计算标准差的列名称。

标准差

返回该列的标准差。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Min()

获取指定数值列的最小值。

Parameters

NameDescriptionDefault
dataGrid The DataGrid containing the column.
columnName The name of the column to analyze.

最小值

返回该列的最小值。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Max()

获取指定数值列的最大值。

Parameters

NameDescriptionDefault
dataGrid 包含该列的数据网格。
columnName 要分析的列的名称。

最大值

返回该列的最大值。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Sum()

计算数据网格中指定列的数值总和。

Parameters

NameDescriptionDefault
dataGrid 包含所需列的数据网格。
columnName 需要进行求和的列的名称。

总和

返回指定数值列的总和。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Correlation()

计算基于指定数值列的两个 DataGrid 之间的相关系数。

Parameters

NameDescriptionDefault
dataGrid1 包含列的第一个 DataGrid。
dataGrid2 包含列的第二个 DataGrid。
columnName1 第一个 DataGrid 中列的名称。
columnName2 第二个 DataGrid 中列的名称。

相关系数

返回两个指定列之间的相关系数。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.Covariance()

计算基于指定数值列的两个DataGrid之间的协方差。

Parameters

NameDescriptionDefault
dataGrid1 包含该列的第一个DataGrid。
dataGrid2 包含该列的第二个DataGrid。
columnName1 第一个DataGrid中列的名称。
columnName2 第二个DataGrid中列的名称。

协方差

返回两个指定列之间的协方差。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.CovarianceMatrix()

计算数据列表的数值列的协方差矩阵。

Remarks

TODO: 冗余,彻底删除此函数 - 或者更新数据列表接口以在此处实现协方差矩阵

Parameters

NameDescriptionDefault
dataGrid 要分析的数据列表。

协方差矩阵数据列表

表示协方差矩阵的数据列表。

Divooka.DataAnalytics.DivookaDataGridOperations.Statistics.PercentReturn()

计算 DataGrid 中每个数值列的百分比收益率。

Parameters

NameDescriptionDefault
dataGrid 包含财务数据的数据网格。
LatestAtTop 确定最新数据是否位于列的顶部。如果为真,则从顶部开始返回计算值。

结果

返回包含百分比收益率的新 DataGrid。

Divooka.DataAnalytics.DivookaDataGridOperations.Preprocessing.Clean()

清洗传入的 DataGrid,报告坏行,并保留好的行。

清洗结果

无返回值(通过引用返回坏行与好行)。

Divooka.DataAnalytics.DataTableExtensions.PrintFormat()

以适合控制台/ASCII 显示的格式输出

格式化字符串

返回格式化后的文本。

Divooka.DataAnalytics.DataTableExtensions.Unwrap``1()

从 DataTable 中通过反射检索目标类型的对象列表; 目标类型必须具有公共属性;属性名不区分大小写

对象列表

返回目标类型的对象列表。

Divooka.DataAnalytics.DataTableExtensions.Single``1()

从单个单元格中获取指定类型的值; 如果无效则抛出异常

单个值

返回目标类型的单个值。

Divooka.DataAnalytics.DataTableExtensions.List``1()

从 DataTable 中提取某列的一组值

值列表

返回一个包含单一类型的值列表。