plain/22.08/_fp32_network_to_bf16_converter_tests_8cpp_source.xhtml

 //
 // Copyright © 2020 Arm Ltd. All rights reserved.
 // SPDX-License-Identifier: MIT
 //

 #include <TestUtils.hpp>

 #include <Optimizer.hpp>

 #include <doctest/doctest.h>

 TEST_SUITE("Optimizer")
 {
 using namespace armnn::optimizations;

 TEST_CASE("Fp32NetworkToBf16OptimizationNoConversionTest")
 {
     armnn::Graph graph;

     const armnn::TensorInfo infoFP32({ 2, 2, 1, 3 }, armnn::DataType::Float32);

     // Create the simple test network without Conv2D/FullyConnected.
     auto input = graph.AddLayer<armnn::InputLayer>(0, "input");
     input->GetOutputSlot().SetTensorInfo(infoFP32);

     auto floor = graph.AddLayer<armnn::FloorLayer>("floor");
     floor->GetOutputSlot().SetTensorInfo(infoFP32);

     auto output = graph.AddLayer<armnn::OutputLayer>(1, "output");

     // Connect up the layers
     input->GetOutputSlot().Connect(floor->GetInputSlot(0));
     floor->GetOutputSlot().Connect(output->GetInputSlot(0));

     CHECK(CheckSequence(graph.cbegin(), graph.cend(), &IsLayerOfType<armnn::InputLayer>,
                              &IsLayerOfType<armnn::FloorLayer>, &IsLayerOfType<armnn::OutputLayer>));

     // Run the optimizer
     armnn::Optimizer::Pass(graph, armnn::MakeOptimizations(Fp32NetworkToBf16Converter()));

     CHECK(CheckSequence(graph.cbegin(), graph.cend(), &IsLayerOfType<armnn::InputLayer>,
                              &IsLayerOfType<armnn::FloorLayer>,
                              &IsLayerOfType<armnn::OutputLayer>));
 }

 TEST_CASE("Fp32NetworkToBf16OptimizationConv2DTest")
 {
     armnn::Graph graph;

     const armnn::TensorInfo infoFP32({ 2, 3, 8, 1 }, armnn::DataType::Float32);

     // Create const tensor fp32 data
     unsigned int dims[] = { 4, 2, 1, 1 };
     std::vector<float> floatWeights{ 0.0f, -1.0f,
                                      3.8f, // 0x40733333 Round down
                                      3.1055E+29f, // 0x707ADC3C Round up
                                      9.149516E-10f, // 0x307B7FFF Round down
                                     -3.8f, // 0xC0733333 Round down
                                     -3.1055E+29f, // 0xF07ADC3C Round up
                                     -9.149516E-10f // 0xB07B7FFF Round down
                                    };
     armnn::ConstTensor weights(armnn::TensorInfo(4, dims, armnn::DataType::Float32, 0.0f, 0, true), floatWeights);

     // Create const bias fp32 data
     unsigned int biasDims[] {4};
     std::vector<float> floatBias{ 1.0f, 2.0f, 3.0f, 4.0f };
     armnn::ConstTensor bias(armnn::TensorInfo(1, biasDims, armnn::DataType::Float32, 0.0f, 0, true), floatBias);

     // A network with Convolution2d layer
     auto input = graph.AddLayer<armnn::InputLayer>(0, "input");
     input->GetOutputSlot().SetTensorInfo(infoFP32);

     armnn::Convolution2dDescriptor descriptor;
     descriptor.m_BiasEnabled = true;
     auto conv = graph.AddLayer<armnn::Convolution2dLayer>(descriptor, "conv2d");
     conv->GetOutputSlot().SetTensorInfo(infoFP32);

     auto weightsLayer = graph.AddLayer<armnn::ConstantLayer>("Weights");
     weightsLayer->m_LayerOutput = std::make_shared<armnn::ScopedTensorHandle>(weights);
     weightsLayer->GetOutputSlot(0).SetTensorInfo(weightsLayer->m_LayerOutput->GetTensorInfo());

     auto biasLayer = graph.AddLayer<armnn::ConstantLayer>("Bias");
     biasLayer->m_LayerOutput = std::make_shared<armnn::ScopedTensorHandle>(bias);
     biasLayer->GetOutputSlot(0).SetTensorInfo(biasLayer->m_LayerOutput->GetTensorInfo());

     auto output = graph.AddLayer<armnn::OutputLayer>(1, "output");

     // Connect up the layers
     input->GetOutputSlot().Connect(conv->GetInputSlot(0));
     weightsLayer->GetOutputSlot(0).Connect(conv->GetInputSlot(1));
     biasLayer->GetOutputSlot(0).Connect(conv->GetInputSlot(2));
     conv->GetOutputSlot().Connect(output->GetInputSlot(0));

     CHECK(CheckSequence(graph.cbegin(), graph.cend(), &IsLayerOfType<armnn::InputLayer>,
                                                       &IsLayerOfType<armnn::ConstantLayer>,
                                                       &IsLayerOfType<armnn::ConstantLayer>,
                                                       &IsLayerOfType<armnn::Convolution2dLayer>,
                                                       &IsLayerOfType<armnn::OutputLayer>));

     // Run the optimizer
     armnn::Optimizer::Pass(graph, armnn::MakeOptimizations(RedirectMembersToConstantInputs(),
                                                            Fp32NetworkToBf16Converter()));

     CHECK(7 == graph.GetNumLayers());
     CHECK(CheckSequence(graph.cbegin(), graph.cend(), &IsLayerOfType<armnn::InputLayer>,
                                                       &IsLayerOfType<armnn::ConstantLayer>,
                                                       &IsLayerOfType<armnn::ConstantLayer>,
                                                       &IsLayerOfType<armnn::ConvertFp32ToBf16Layer>,
                                                       &IsLayerOfType<armnn::ConvertFp32ToBf16Layer>,
                                                       &IsLayerOfType<armnn::Convolution2dLayer>,
                                                       &IsLayerOfType<armnn::OutputLayer>));

     armnn::TensorInfo inputTensor = conv->GetInputSlot(0).GetConnectedOutputSlot()->GetTensorInfo();
     armnn::TensorInfo weightTensor = conv->GetInputSlot(1).GetConnectedOutputSlot()->GetTensorInfo();
     armnn::TensorInfo biasTensor = conv->GetInputSlot(2).GetConnectedOutputSlot()->GetTensorInfo();
     armnn::TensorInfo outputTensor = conv->GetOutputSlot(0).GetTensorInfo();
     CHECK((conv->GetDataType() == armnn::DataType::BFloat16));
     CHECK((conv->m_Weight->GetTensorInfo().GetDataType() == armnn::DataType::BFloat16));
     CHECK((conv->m_Bias->GetTensorInfo().GetDataType() == armnn::DataType::Float32));
     CHECK((inputTensor.GetDataType() == armnn::DataType::BFloat16));
     CHECK((weightTensor.GetDataType() == armnn::DataType::BFloat16));
     CHECK((biasTensor.GetDataType() == armnn::DataType::Float32));
     CHECK((outputTensor.GetDataType() == armnn::DataType::Float32));

     // Check whether data matches expected Bf16 data
     const armnn::BFloat16* data = conv->m_Weight->GetConstTensor<armnn::BFloat16>();
     CHECK(data[0] == armnn::BFloat16(0.0f));
     CHECK(data[1] == armnn::BFloat16(-1.0f));
     CHECK(data[2] == armnn::BFloat16(3.796875f)); // 0x4073
     CHECK(data[3] == armnn::BFloat16(3.1072295E29f)); // 0x707B
     CHECK(data[4] == armnn::BFloat16(9.131327E-10f)); // 0x307B
     CHECK(data[5] == armnn::BFloat16(-3.796875f)); // 0xC073
     CHECK(data[6] == armnn::BFloat16(-3.1072295E29f)); // 0xF07B
     CHECK(data[7] == armnn::BFloat16(-9.131327E-10f)); // 0xB07B
 }

 TEST_CASE("Fp32NetworkToBf16OptimizationFullyConnectedTest")
 {
     armnn::Graph graph;

     const armnn::TensorInfo infoFP32({ 2, 3, 8, 1 }, armnn::DataType::Float32);

     // Create const tensor fp32 data
     unsigned int dims[] = { 4, 2, 1, 1 };
     std::vector<float> floatWeights{ 0.0f, -1.0f,
                                      3.8f, // 0x40733333 Round down
                                      3.1055E+29f, // 0x707ADC3C Round up
                                      9.149516E-10f, // 0x307B7FFF Round down
                                     -3.8f, // 0xC0733333 Round down
                                     -3.1055E+29f, // 0xF07ADC3C Round up
                                     -9.149516E-10f // 0xB07B7FFF Round down
                                    };
     armnn::ConstTensor weights(armnn::TensorInfo(4, dims, armnn::DataType::Float32, 0.0f, 0, true), floatWeights);

     // Create const bias fp32 data
     unsigned int biasDims[] {4};
     std::vector<float> floatBias{ 1.0f, 2.0f, 3.0f, 4.0f };
     armnn::ConstTensor bias(armnn::TensorInfo(1, biasDims, armnn::DataType::Float32, 0.0f, 0, true), floatBias);

     // A network with FullyConnected layer
     auto input = graph.AddLayer<armnn::InputLayer>(0, "input");
     input->GetOutputSlot().SetTensorInfo(infoFP32);

     armnn::FullyConnectedDescriptor descriptor;
     descriptor.m_BiasEnabled = true;

     auto fc = graph.AddLayer<armnn::FullyConnectedLayer>(descriptor, "fully");
     fc->GetOutputSlot().SetTensorInfo(infoFP32);

     auto weightsLayer = graph.AddLayer<armnn::ConstantLayer>("Weights");
     weightsLayer->m_LayerOutput = std::make_shared<armnn::ScopedTensorHandle>(weights);
     weightsLayer->GetOutputSlot(0).SetTensorInfo(weightsLayer->m_LayerOutput->GetTensorInfo());

     auto biasLayer = graph.AddLayer<armnn::ConstantLayer>("Bias");
     biasLayer->m_LayerOutput = std::make_shared<armnn::ScopedTensorHandle>(bias);
     biasLayer->GetOutputSlot(0).SetTensorInfo(biasLayer->m_LayerOutput->GetTensorInfo());

     auto output = graph.AddLayer<armnn::OutputLayer>(1, "output");

     // Connect up the layers
     input->GetOutputSlot().Connect(fc->GetInputSlot(0));
     weightsLayer->GetOutputSlot(0).Connect(fc->GetInputSlot(1));
     biasLayer->GetOutputSlot(0).Connect(fc->GetInputSlot(2));
     fc->GetOutputSlot().Connect(output->GetInputSlot(0));

     CHECK(CheckSequence(graph.cbegin(), graph.cend(), &IsLayerOfType<armnn::InputLayer>,
                                                       &IsLayerOfType<armnn::ConstantLayer>,
                                                       &IsLayerOfType<armnn::ConstantLayer>,
                                                       &IsLayerOfType<armnn::FullyConnectedLayer>,
                                                       &IsLayerOfType<armnn::OutputLayer>));

     // Run the optimizer
     armnn::Optimizer::Pass(graph, armnn::MakeOptimizations(RedirectMembersToConstantInputs(),
                                                            Fp32NetworkToBf16Converter()));

     CHECK(7 == graph.GetNumLayers());
     CHECK(CheckSequence(graph.cbegin(), graph.cend(), &IsLayerOfType<armnn::InputLayer>,
                                                       &IsLayerOfType<armnn::ConstantLayer>,
                                                       &IsLayerOfType<armnn::ConstantLayer>,
                                                       &IsLayerOfType<armnn::ConvertFp32ToBf16Layer>,
                                                       &IsLayerOfType<armnn::ConvertFp32ToBf16Layer>,
                                                       &IsLayerOfType<armnn::FullyConnectedLayer>,
                                                       &IsLayerOfType<armnn::OutputLayer>));

     armnn::TensorInfo inputTensor = fc->GetInputSlot(0).GetConnectedOutputSlot()->GetTensorInfo();
     armnn::TensorInfo weightTensor = fc->GetInputSlot(1).GetConnectedOutputSlot()->GetTensorInfo();
     armnn::TensorInfo biasTensor = fc->GetInputSlot(2).GetConnectedOutputSlot()->GetTensorInfo();
     armnn::TensorInfo outputTensor = fc->GetOutputSlot(0).GetTensorInfo();
     CHECK((fc->GetDataType() == armnn::DataType::BFloat16));
     CHECK((fc->m_Weight->GetTensorInfo().GetDataType() == armnn::DataType::BFloat16));
     CHECK((fc->m_Bias->GetTensorInfo().GetDataType() == armnn::DataType::Float32));
     CHECK((inputTensor.GetDataType() == armnn::DataType::BFloat16));
     CHECK((weightTensor.GetDataType() == armnn::DataType::BFloat16));
     CHECK((biasTensor.GetDataType() == armnn::DataType::Float32));
     CHECK((outputTensor.GetDataType() == armnn::DataType::Float32));

     // Check whether data matches expected Bf16 data
     const armnn::BFloat16* data = fc->m_Weight->GetConstTensor<armnn::BFloat16>();
     CHECK(data[0] == armnn::BFloat16(0.0f));
     CHECK(data[1] == armnn::BFloat16(-1.0f));
     CHECK(data[2] == armnn::BFloat16(3.796875f)); // 0x4073
     CHECK(data[3] == armnn::BFloat16(3.1072295E29f)); // 0x707B
     CHECK(data[4] == armnn::BFloat16(9.131327E-10f)); // 0x307B
     CHECK(data[5] == armnn::BFloat16(-3.796875f)); // 0xC073
     CHECK(data[6] == armnn::BFloat16(-3.1072295E29f)); // 0xF07B
     CHECK(data[7] == armnn::BFloat16(-9.131327E-10f)); // 0xB07B
 }

 }
armnn::ConstantLayer
A layer that the constant data can be bound to.
Definition: ConstantLayer.hpp:15

armnn::Convolution2dDescriptor::m_BiasEnabled
bool m_BiasEnabled
Enable/disable bias.
Definition: Descriptors.hpp:543

armnn::MakeOptimizations
Optimizer::Optimizations MakeOptimizations(Args &&... args)
Definition: Optimizer.hpp:43

CheckSequence
bool CheckSequence(const armnn::Graph::ConstIterator first, const armnn::Graph::ConstIterator last)
Definition: TestUtils.hpp:21

armnn::TensorInfo
Definition: Tensor.hpp:152

armnn::optimizations
Definition: AddBroadcastReshapeLayer.hpp:15

armnn::ConstantLayer::m_LayerOutput
std::shared_ptr< ConstTensorHandle > m_LayerOutput
Definition: ConstantLayer.hpp:44

armnn::Graph::AddLayer
LayerT * AddLayer(Args &&... args)
Adds a new layer, of type LayerType, to the graph constructed with the arguments passed.
Definition: Graph.hpp:456

armnn::Graph::cbegin
ConstIterator cbegin() const
Returns const iterator pointing to the beginning of the list. Lowercase for range-based for loops...
Definition: Graph.hpp:179

armnn::Convolution2dDescriptor
A Convolution2dDescriptor for the Convolution2dLayer.
Definition: Descriptors.hpp:495

armnn::BFloat16
Definition: BFloat16.hpp:15

armnn::OutputSlot::Connect
int Connect(InputSlot &destination)
Definition: Layer.cpp:112

armnn::Optimizer::Pass
static void Pass(Graph &graph, const Optimizations &optimizations)
Definition: Optimizer.cpp:16

armnn::optimizations::RedirectMembersToConstantInputs
OptimizeForType< Layer, RedirectMembersToConstantInputsImpl > RedirectMembersToConstantInputs
Definition: RedirectMembersToConstantInputs.hpp:85

Optimizer.hpp

TEST_SUITE
TEST_SUITE("Optimizer")
Definition: Fp32NetworkToBf16ConverterTests.cpp:12

armnn::OutputLayer
A layer user-provided data can be bound to (e.g. inputs, outputs).
Definition: OutputLayer.hpp:13

armnn::FullyConnectedLayer
This layer represents a fully connected operation.
Definition: FullyConnectedLayer.hpp:15

armnn::TensorInfo::GetDataType
DataType GetDataType() const
Definition: Tensor.hpp:198

armnn::FullyConnectedDescriptor
A FullyConnectedDescriptor for the FullyConnectedLayer.
Definition: Descriptors.hpp:468

armnn::FullyConnectedDescriptor::m_BiasEnabled
bool m_BiasEnabled
Enable/disable bias.
Definition: Descriptors.hpp:487

armnn::ConstTensor
A tensor defined by a TensorInfo (shape and data type) and an immutable backing store.
Definition: Tensor.hpp:327

armnn::DataType::BFloat16

armnn::FloorLayer
This layer represents a floor operation.
Definition: FloorLayer.hpp:13

armnn::Graph
Definition: Graph.hpp:30

armnn::InputLayer
A layer user-provided data can be bound to (e.g. inputs, outputs).
Definition: InputLayer.hpp:13

armnn::OutputSlot::SetTensorInfo
void SetTensorInfo(const TensorInfo &tensorInfo) override
Definition: Layer.cpp:87

armnn::Layer::GetOutputSlot
const OutputSlot & GetOutputSlot(unsigned int index=0) const override
Get the const output slot handle by slot index.
Definition: Layer.hpp:326

armnn::DataType::Float32

armnn::Graph::cend
ConstIterator cend() const
Returns const iterator pointing to the end of the list. Lowercase for range-based for loops...
Definition: Graph.hpp:181

armnn::Convolution2dLayer
This layer represents a convolution 2d operation.
Definition: Convolution2dLayer.hpp:15

armnn::Graph::GetNumLayers
size_t GetNumLayers() const
Definition: Graph.hpp:198

armnn::optimizations::Fp32NetworkToBf16Converter
OptimizeForType< Layer, ConvertFp32NetworkToBf16Impl > Fp32NetworkToBf16Converter
Definition: ConvertFp32NetworkToBf16.hpp:76