Elle a l'avantage de se vectoriser très bien, et d'éviter le passage par une multiplication. Elle reste moins bonne que la version de référence, sauf dans les cas dégénérés (pas de zéro p.e.). On notera qu'on pourrait aussi passer la boucle interne sous OpenMP :-)
# Quitte à faire du branchless
Posté par serge_sans_paille (site web personnel) . En réponse au journal Exercices de programmation et benchmarks. Évalué à 4.
Je te propose cette légère amélioration :
Elle a l'avantage de se vectoriser très bien, et d'éviter le passage par une multiplication. Elle reste moins bonne que la version de référence, sauf dans les cas dégénérés (pas de zéro p.e.). On notera qu'on pourrait aussi passer la boucle interne sous OpenMP :-)
Cas dégénéré : http://quick-bench.com/PTIzGKHuheFGyKEVjkAPBwgDo4s
Cas normal : http://quick-bench.com/goZHQlQ10U4sDqMiEP0nMyyXUBs
Merci pour ce petit jeu d'esprit !