Floating Point Arithmetic library
The Floating Point Arithmetic library contains components that operate on floating-point values. The Float size attribute selects an 8-bit minifloat (one sign bit, four exponent bits, and three fraction bits), or an IEEE 754 binary16, binary32, or binary64 representation.
Most arithmetic and mathematical-function components provide a one-bit ERR output. Its exact condition is described on each component page. An input containing unknown or error bits is converted to NaN.
Basic operations
|
|
Floating Point Adder | |
|
|
Floating Point Subtractor | |
|
|
Floating Point Multiplier | |
|
|
Floating Point Divider | |
|
|
Floating Point Negator |
Mathematical functions
| yx | Floating Point Exponentiator | |
| log | Floating Point Logarithm | |
| √ | Floating Point Square Root | |
| |x| | Floating Point Absolute |
Comparison, rounding, and classification
| ≶ | Floating Point Comparator | |
| min/max | Floating Point Minimum and Maximum | |
| round | Floating Point Round | |
| sin/cos | Floating Point Trigonometry | |
| class | Floating Point Classificator |
Conversions
| FP→FP | Floating Point Converter | |
| FP→I | Floating Point to Integer | |
| I→FP | Integer to Floating Point |
Back to Library Reference