Floating Point Arithmetic library

The Floating Point Arithmetic library contains components that operate on floating-point values. The Float size attribute selects an 8-bit minifloat (one sign bit, four exponent bits, and three fraction bits), or an IEEE 754 binary16, binary32, or binary64 representation.

Most arithmetic and mathematical-function components provide a one-bit ERR output. Its exact condition is described on each component page. An input containing unknown or error bits is converted to NaN.

Basic operations

Adder icon   Floating Point Adder
Subtractor icon   Floating Point Subtractor
Multiplier icon   Floating Point Multiplier
Divider icon   Floating Point Divider
Negator icon   Floating Point Negator

Mathematical functions

yx   Floating Point Exponentiator
log   Floating Point Logarithm
√   Floating Point Square Root
|x|   Floating Point Absolute

Comparison, rounding, and classification

≶   Floating Point Comparator
min/max   Floating Point Minimum and Maximum
round   Floating Point Round
sin/cos   Floating Point Trigonometry
class   Floating Point Classificator

Conversions

FP→FP   Floating Point Converter
FP→I   Floating Point to Integer
I→FP   Integer to Floating Point

Back to Library Reference