14#include "mlir/Analysis/TopologicalSortUtils.h"
15#include "mlir/Dialect/Func/IR/FuncOps.h"
16#include "mlir/IR/PatternMatch.h"
17#include "mlir/Pass/Pass.h"
18#include "mlir/Transforms/GreedyPatternRewriteDriver.h"
19#include "llvm/Support/Debug.h"
20#include "llvm/Support/KnownBits.h"
23#define DEBUG_TYPE "datapath-to-comb"
26#define GEN_PASS_DEF_CONVERTDATAPATHTOCOMB
27#include "circt/Conversion/Passes.h.inc"
31using namespace datapath;
34static SmallVector<Value>
extractBits(OpBuilder &builder, Value val) {
35 SmallVector<Value> bits;
36 comb::extractBits(builder, val, bits);
42static std::pair<bool, Value>
getBaseOfExt(PatternRewriter &rewriter,
43 Location loc, Value val) {
47 if (matchPattern(val, comb::m_ZextBy(mlir::matchers::m_Any(&replBits)))) {
48 auto baseWidth = val.getType().getIntOrFloatBitWidth() -
49 replBits.getType().getIntOrFloatBitWidth();
52 return {
false, valBase};
56 if (matchPattern(val, comb::m_SextBy(mlir::matchers::m_Any(&replBits)))) {
57 auto baseWidth = val.getType().getIntOrFloatBitWidth() -
58 replBits.getType().getIntOrFloatBitWidth();
61 return {
true, valBase};
79 matchAndRewrite(CompressOp op,
80 mlir::PatternRewriter &rewriter)
const override {
81 Location loc = op.getLoc();
82 auto inputs = op.getOperands();
83 unsigned width = inputs[0].getType().getIntOrFloatBitWidth();
85 auto addOp = comb::AddOp::create(rewriter, loc, inputs,
true);
88 SmallVector<Value> results(op.getNumResults() - 1, zeroOp);
89 results.push_back(addOp);
90 rewriter.replaceOp(op, results);
97 DatapathCompressOpConversion(MLIRContext *
context,
102 matchAndRewrite(CompressOp op,
103 mlir::PatternRewriter &rewriter)
const override {
104 Location loc = op.getLoc();
105 auto inputs = op.getOperands();
107 SmallVector<SmallVector<Value>> addends;
108 for (
auto input : inputs) {
114 auto width = inputs[0].getType().getIntOrFloatBitWidth();
115 auto targetAddends = op.getNumResults();
120 if (failed(comp.withInputDelays(
121 [&](Value v) { return analysis->getMaxDelay(v, 0); })))
125 rewriter.replaceOp(op, comp.compressToHeight(rewriter, targetAddends));
133struct DatapathPartialProductOpConversion :
OpRewritePattern<PartialProductOp> {
136 DatapathPartialProductOpConversion(MLIRContext *
context,
bool forceBooth)
139 const bool forceBooth;
141 LogicalResult matchAndRewrite(PartialProductOp op,
142 PatternRewriter &rewriter)
const override {
144 Value a = op.getLhs();
145 Value b = op.getRhs();
146 unsigned width = a.getType().getIntOrFloatBitWidth();
150 rewriter.replaceOpWithNewOp<
hw::ConstantOp>(op, op.getType(0), 0);
167 return lowerSqrAndArray(rewriter, a, op, width);
171 if (comb::shouldUseBoothEncoding(a, b) || forceBooth)
172 return lowerBoothArray(rewriter, a, b, op, width);
174 return lowerAndArray(rewriter, a, b, op, width);
178 static LogicalResult lowerAndArray(PatternRewriter &rewriter, Value a,
179 Value b, PartialProductOp op,
182 Location loc = op.getLoc();
184 SmallVector<Value> bBits =
extractBits(rewriter, b);
185 auto knownBitsB = comb::computeKnownBits(b);
187 auto rowWidth = width;
188 auto knownBitsA = comb::computeKnownBits(a);
189 if (!knownBitsA.Zero.isZero()) {
190 if (knownBitsA.Zero.countLeadingOnes() > 1) {
191 rowWidth -= knownBitsA.Zero.countLeadingOnes();
196 SmallVector<Value> partialProducts;
197 partialProducts.reserve(width);
200 assert(op.getNumResults() <= width &&
201 "Cannot return more results than the operator width");
203 for (
unsigned i = 0; i < op.getNumResults(); ++i) {
208 if (knownBitsB.Zero[i]) {
209 partialProducts.push_back(
215 if (knownBitsB.One[i]) {
219 rewriter.createOrFold<comb::ReplicateOp>(loc, bBits[i], rowWidth);
220 ppRow = rewriter.createOrFold<
comb::AndOp>(loc, repl, a);
222 if (rowWidth < width) {
223 auto padding = width - rowWidth;
226 loc, ValueRange{
zeroPad, ppRow});
230 partialProducts.push_back(ppRow);
235 comb::ConcatOp::create(rewriter, loc, ValueRange{ppRow, shiftBy});
237 loc, ppAlign, 0, width);
238 partialProducts.push_back(ppAlignTrunc);
241 rewriter.replaceOp(op, partialProducts);
245 static LogicalResult lowerSqrAndArray(PatternRewriter &rewriter, Value a,
246 PartialProductOp op,
unsigned width) {
248 Location loc = op.getLoc();
249 SmallVector<Value> aBits =
extractBits(rewriter, a);
251 SmallVector<Value> partialProducts;
252 partialProducts.reserve(width);
256 assert(op.getNumResults() <= width &&
257 "Cannot return more results than the operator width");
259 for (
unsigned i = 0; i < op.getNumResults(); ++i) {
260 SmallVector<Value> row;
263 if (2 * i >= width) {
266 partialProducts.push_back(zeroWidth);
272 row.push_back(shiftBy);
274 row.push_back(aBits[i]);
277 unsigned rowWidth = 2 * i + 1;
278 if (rowWidth < width) {
279 row.push_back(zeroFalse);
283 for (
unsigned j = i + 1; j < width; ++j) {
285 if (rowWidth == width)
291 if (j >= op.getNumResults()) {
292 row.push_back(zeroFalse);
297 rewriter.createOrFold<
comb::AndOp>(loc, aBits[i], aBits[j]);
298 row.push_back(ppBit);
300 std::reverse(row.begin(), row.end());
301 auto ppRow = comb::ConcatOp::create(rewriter, loc, row);
302 partialProducts.push_back(ppRow);
305 rewriter.replaceOp(op, partialProducts);
309 static LogicalResult lowerBoothArray(PatternRewriter &rewriter, Value a,
310 Value b, PartialProductOp op,
313 Location loc = op.getLoc();
316 auto [aSigned, aBase] =
getBaseOfExt(rewriter, loc, op.getLhs());
317 auto [bSigned, bBase] =
getBaseOfExt(rewriter, loc, op.getRhs());
319 auto aBaseWidth = aBase.getType().getIntOrFloatBitWidth();
320 auto bBaseWidth = bBase.getType().getIntOrFloatBitWidth();
324 auto rowWidth = width;
325 if (aBaseWidth < width) {
327 rowWidth = aBaseWidth + 1;
333 rewriter.createOrFold<
comb::ConcatOp>(loc, ValueRange{a, zeroFalse});
335 loc, twoAPre, 0, rowWidth);
339 SmallVector<Value> bBits =
extractBits(rewriter, b);
341 bBits.push_back(zeroFalse);
342 bBits.push_back(zeroFalse);
347 bBits.resize(bBaseWidth + 2);
351 bBits.resize(bBaseWidth + 1);
353 SmallVector<Value> partialProducts;
354 partialProducts.reserve(op.getNumResults());
361 SmallVector<Value> encNegs;
365 for (
unsigned i = 0; i + 1 < bBits.size(); i += 2) {
367 Value bim1 = (i == 0) ? zeroFalse : bBits[i - 1];
369 Value bip1 = bBits[i + 1];
373 encNegs.push_back(encNeg);
375 Value encOne = rewriter.createOrFold<
comb::XorOp>(loc, bi, bim1,
true);
378 Value biInv = rewriter.createOrFold<
comb::XorOp>(loc, bi, constOne,
true);
380 rewriter.createOrFold<
comb::XorOp>(loc, bip1, constOne,
true);
382 rewriter.createOrFold<
comb::XorOp>(loc, bim1, constOne,
true);
384 Value andLeft = rewriter.createOrFold<
comb::AndOp>(
385 loc, ValueRange{bip1Inv, bi, bim1},
true);
386 Value andRight = rewriter.createOrFold<
comb::AndOp>(
387 loc, ValueRange{bip1, biInv, bim1Inv},
true);
389 rewriter.createOrFold<
comb::OrOp>(loc, andLeft, andRight,
true);
392 rewriter.createOrFold<comb::ReplicateOp>(loc, encNeg, rowWidth);
394 rewriter.createOrFold<comb::ReplicateOp>(loc, encOne, rowWidth);
396 rewriter.createOrFold<comb::ReplicateOp>(loc, encTwo, rowWidth);
399 Value selTwoA = rewriter.createOrFold<
comb::AndOp>(loc, encTwoRepl, twoA);
400 Value selOneA = rewriter.createOrFold<
comb::AndOp>(loc, encOneRepl, a);
402 rewriter.createOrFold<
comb::OrOp>(loc, selTwoA, selOneA,
true);
406 rewriter.createOrFold<
comb::XorOp>(loc, magA, encNegRepl,
true);
410 partialProducts.push_back(ppRow);
417 loc, ValueRange{ppRow, zeroFalse, encNegPrev});
418 partialProducts.push_back(withSignCorrection);
427 loc, ValueRange{ppRow, zeroFalse, encNegPrev, shiftBy});
428 partialProducts.push_back(withSignCorrection);
431 if (partialProducts.size() == op.getNumResults())
438 auto numPP = partialProducts.size();
441 Value finalSignCorrection = rewriter.createOrFold<
comb::ConcatOp>(
442 loc, ValueRange{zeroFalse, encNegPrev, shiftByFinal});
443 partialProducts.push_back(finalSignCorrection);
444 encNegs.push_back(zeroFalse);
454 for (
unsigned i = 0; i < partialProducts.size(); ++i) {
455 auto ppRow = partialProducts[i];
457 auto ppWidth = ppRow.getType().getIntOrFloatBitWidth();
458 if (ppWidth < width) {
459 auto padding = width - ppWidth;
460 auto encNeg = encNegs[i];
467 rewriter.createOrFold<comb::ReplicateOp>(loc, encNeg, padding);
469 loc, ValueRange{encNegPad, ppRow});
473 ppWidth = ppRow.getType().getIntOrFloatBitWidth();
474 if (ppWidth > width) {
477 partialProducts[i] = ppRow;
478 assert(partialProducts[i].getType().getIntOrFloatBitWidth() == width &&
479 "Expected sign-extended partial product to be full width");
484 while (partialProducts.size() < op.getNumResults())
485 partialProducts.push_back(zeroWidth);
487 assert(partialProducts.size() == op.getNumResults() &&
488 "Expected number of booth partial products to match results");
490 rewriter.replaceOp(op, partialProducts);
495struct DatapathPosPartialProductOpConversion
499 DatapathPosPartialProductOpConversion(MLIRContext *
context,
bool forceBooth)
501 forceBooth(forceBooth){};
503 const bool forceBooth;
505 LogicalResult matchAndRewrite(PosPartialProductOp op,
506 PatternRewriter &rewriter)
const override {
508 Value a = op.getAddend0();
509 Value b = op.getAddend1();
510 Value c = op.getMultiplicand();
511 unsigned width = a.getType().getIntOrFloatBitWidth();
515 rewriter.replaceOpWithNewOp<
hw::ConstantOp>(op, op.getType(0), 0);
520 return lowerAndArray(rewriter, a, b, c, op, width);
524 static LogicalResult lowerAndArray(PatternRewriter &rewriter, Value a,
525 Value b, Value c, PosPartialProductOp op,
528 Location loc = op.getLoc();
531 auto carry = rewriter.createOrFold<
comb::AndOp>(loc, a, b);
532 auto save = rewriter.createOrFold<
comb::XorOp>(loc, a, b);
534 SmallVector<Value> carryBits =
extractBits(rewriter, carry);
535 SmallVector<Value> saveBits =
extractBits(rewriter, save);
538 auto rowWidth = width;
540 auto cBaseWidth = cBase.getType().getIntOrFloatBitWidth();
542 if (cBaseWidth < width && !cSigned) {
544 rowWidth = cBaseWidth + 1;
551 comb::ConcatOp::create(rewriter, loc, ValueRange{c, zeroFalse});
557 SmallVector<Value> partialProducts;
558 partialProducts.reserve(width);
560 assert(op.getNumResults() <= width &&
561 "Cannot return more results than the operator width");
563 for (
unsigned i = 0; i < op.getNumResults(); ++i) {
565 rewriter.createOrFold<comb::ReplicateOp>(loc, saveBits[i], rowWidth);
567 rewriter.createOrFold<comb::ReplicateOp>(loc, carryBits[i], rowWidth);
569 auto ppRowSave = rewriter.createOrFold<
comb::AndOp>(loc, replSave, c);
571 rewriter.createOrFold<
comb::AndOp>(loc, replCarry, twoC);
573 rewriter.createOrFold<
comb::OrOp>(loc, ppRowSave, ppRowCarry);
574 auto ppAlign = ppRow;
578 comb::ConcatOp::create(rewriter, loc, ValueRange{ppRow, shiftBy});
582 if (rowWidth + i > width) {
585 partialProducts.push_back(ppAlignTrunc);
589 if (rowWidth + i < width) {
590 auto extPPAlign = comb::createZExt(rewriter, loc, ppAlign, width);
591 partialProducts.push_back(extPPAlign);
595 partialProducts.push_back(ppAlign);
598 rewriter.replaceOp(op, partialProducts);
610struct ConvertDatapathToCombPass
611 :
public impl::ConvertDatapathToCombBase<ConvertDatapathToCombPass> {
612 void runOnOperation()
override;
613 using ConvertDatapathToCombBase<
614 ConvertDatapathToCombPass>::ConvertDatapathToCombBase;
619 Operation *op, RewritePatternSet &&
patterns,
623 mlir::GreedyRewriteConfig config;
628 config.setMaxIterations(2).setListener(analysis).setUseTopDownTraversal(
true);
631 if (failed(mlir::applyPatternsGreedily(op, std::move(
patterns), config)))
637void ConvertDatapathToCombPass::runOnOperation() {
638 RewritePatternSet
patterns(&getContext());
640 patterns.add<DatapathPartialProductOpConversion,
641 DatapathPosPartialProductOpConversion>(
patterns.getContext(),
645 analysis = &getAnalysis<synth::IncrementalLongestPathAnalysis>();
647 if (lowerCompressToAdd)
652 patterns.add<DatapathCompressOpConversion>(
patterns.getContext(), analysis);
655 getOperation(), std::move(
patterns), analysis)))
656 return signalPassFailure();
661 auto result = getOperation()->walk([&](Operation *op) {
662 if (llvm::isa<datapath::CompressOp>(op) && !lowerCompress &&
664 return WalkResult::advance();
665 if (llvm::isa_and_nonnull<datapath::DatapathDialect>(op->getDialect())) {
666 op->emitError(
"Datapath operation not converted: ") << *op;
667 return WalkResult::interrupt();
669 return WalkResult::advance();
671 if (result.wasInterrupted())
672 return signalPassFailure();
assert(baseType &&"element must be base type")
static SmallVector< Value > extractBits(OpBuilder &builder, Value val)
static Value zeroPad(PatternRewriter &rewriter, Location loc, Value input, size_t targetWidth, size_t trailingZeros)
static std::pair< bool, Value > getBaseOfExt(PatternRewriter &rewriter, Location loc, Value val)
static SmallVector< Value > extractBits(OpBuilder &builder, Value val)
static LogicalResult applyPatternsGreedilyWithTimingInfo(Operation *op, RewritePatternSet &&patterns, synth::IncrementalLongestPathAnalysis *analysis)
static std::unique_ptr< Context > context
The InstanceGraph op interface, see InstanceGraphInterface.td for more details.